Инструменты в помощь аналитику данных

«Коробочные» решения, библиотеки для глубинного обучения и сервисы для создания интерактивных графиков

Инструменты в помощь аналитику данных

Анализ данных

Подборка полезных библиотек и сервисов для тех, кто хочет работать аналитиком — или освоить анализ данных для себя.

Python для анализа данных

Знание языка программирования Python — одно из самых распространённых требований для вакансий аналитика. А чтобы упростить написание кода на нём, можно воспользоваться библиотеками: шаблонами решений для стандартных задач.

Jupyter

alt

Jupyter Notebook — бесплатная интерактивная оболочка для Python. Она позволяет объединить код, текст и диаграммы — и делиться результатом с другими пользователями.

Библиотеки

Pandas

Pandas пригодится для анализа неполных и неупорядоченных данных (в таком виде они чаще всего и встречаются в жизни). В этой библиотеке есть готовые методы для их фильтрации, группировки и объединения.

TensorFlow

TensorFlow — библиотека для глубинного обучения, разработанная в Google. Она нужна, чтобы тренировать нейронные сети для автоматического нахождения и классификации образов.

Она пригодится для:

  • Распознавания речи и изображений
  • Работы с текстом
  • Анализа временных рядов
  • Распознавания объектов на видео

NumPy и SciPy

NumPy упрощает работу с векторами и матрицами: от расчета определителей матриц до решения линейных уравнений. SciPy расширяет возможности первой библиотеки и позволяет работать с вероятностными распределениями и интегральным исчислением.

Matplotlib

alt

Matplotlib пригодится для создания графиков: от круговых диаграмм до контурных схем.

«Коробочные» решения

Готовые решения для анализа данных пригодятся тем, кто пока не умеет программировать — но уже хочет получить инсайты о продукте. Основной недостаток: платное использование.

Mixpanel

alt

С помощью сервиса можно увидеть, как клиенты взаимодействуют с вашим приложением или сайтом и найти закономерности в их поведении. Также сервис позволяет проводить A/B-тестирования — эксперименты, в ходе которых тестируется, как изменения в продукте влияют на пользовательский опыт.

Amplitude

alt

Amplitude помогает отследить, как меняются и от чего зависят продуктовые метрики (например, конверсия в платящих пользователей). Так, в сервисе можно задать долгосрочную цель вашего сервиса и проанализировать, что поможет её достижению.

Tableau

alt

Tableau — это корпоративная система бизнес-аналитики. С её помощью можно подготовить (упорядочить и промаркировать) данные для анализа, найти в них закономерности и визуализировать выводы.

Другое

Если вам не хватает стандартных инструментов, то вы можете воспользоваться сервисами для отдельных задач: например, для создания интерактивных графиков или работы с маркетинговыми данными.

Plotly

alt

Plotly нужен для создания сложной визуализации: например, интерактивных или 3D-графиков.

Improvado.io

alt

Improvado — сервис для маркетинговой аналитики. С его помощью можно агрегировать данные с разных платформ в один инструмент: например, Tableau, Excel или Looker.

Больше по теме

Анализ данных

Чем занимаются лауреаты премии имени Ильи Сегаловича 2019

Исследования в сфере компьютерного зрения, распознавание эмоций и применение машинного обучения для развития Нижегородской области

Анализ данных

Зачем специалисту по data science нужна экономика?

Разработчик deep learning в Яндекс.Такси о своём переходе из экономики в науки о данных

Анализ данных, Разработка

Чем занимается разработчик инфраструктуры и как им стать

«Для нас все остальные разработчики Яндекса — пользователи»

Анализ данных

Научить Алису предсказывать намерения пользователя и разобраться в инфраструктуре Amazon

Какие проекты реализовали участники интенсива по машинному обучению от Яндекса и Университета «Сириус»

Анализ данных

Какой будет совместная лаборатория Яндекса и МФТИ

«Лаборатория это возможность не делать что-то сиюминутное, не "пилить тулзу", а создавать научное знание, публиковаться в журналах и на крутых конференциях»

Анализ данных

Сдать ЕГЭ по русскому с помощью машинного обучения

Интервью с победителями AI Journey 2019

Анализ данных

Онлайн-магистратура по наукам о данных

Совместно с Яндексом Высшая школа экономики открыла набор в англоязычную онлайн-магистратуру по data science на платформе Coursera