-
Сглаживание временных рядов и шума в данных с помощью Kalman Filter
В мире анализа данных и машинного обучения мы часто сталкиваемся с временными рядами, которые содержат значительное количество шума. Этот шум может затруднять выявление истинных закономерностей и трендов, критически важных для принятия обоснованных решений. Именно поэтому сглаживание временных рядов и фильтрация шума стали неотъемлемой частью предобработки данных в различных областях: от финансового прогнозирования до управления автономными…
-
Прогнозирование трафика и конверсий сайта с помощью Prophet
Prophet — это библиотека с открытым исходным кодом, разработанная специально для прогнозирования временных рядов. Она основана на декомпозиционной модели, которая учитывает тренд, сезонность и праздничные эффекты. Prophet особенно хорошо подходит для задач прогнозирования с сильными сезонными паттернами и несколькими циклами в исторических данных. Ключевые особенности Prophet: Простота использования: не требует глубоких знаний в области статистики…
-
Прогнозирование трафика и конверсий сайта с помощью LightGBM
LightGBM (Light Gradient Boosting Machine) — это высокоэффективная реализация градиентного бустинга, которая в последние годы завоевала популярность среди специалистов по машинному обучению благодаря своей скорости и точности. В этой статье мы глубоко погрузимся в то, как использовать LightGBM для прогнозирования ключевых метрик веб-сайта, рассмотрим конкретные примеры кода и обсудим лучшие практики. Почему LightGBM является эффективным…
-
Поиск и анализ аномалий в сырых данных веб-аналитики с помощью Python
Аномалии в трафике, конверсиях, поведении пользователей на сайте могут рассказать многое о здоровье веб-сайта. И если научиться их своевременно выявлять, то можно сэкономить множество сил, нервов, времени и денег. Простой пример — аномально высокая конверсия по одной из целей может быть следствием «наплыва» ботов на сайт и если это вовремя не обнаружить и не остановить…
-
Новейшие модели прогнозирования временных рядов
Прогнозирование временных рядов — одна из важнейших задач в области data science. Долгое время эти задачи не доверяли нейронным сетям: исследователи предпочитали использовать быстрые, надежные и понятные методы классического машинного обучения. К тому же, точность нейронок в таких задачах оставляла желать лучшего. Однако, в последние годы кое-что изменилось — нейросети начали побеждать классические ML алгоритмы…