Статистический анализ с NumPy, Pandas

25 участников

О чём курс

Работа с данными требует не только знания Python, но и умения эффективно готовить, очищать и анализировать массивы информации. Здесь разбираются инструменты для автоматизации статистических расчетов и подготовки датасетов, которые лежат в основе Data Science.

Внутри курса разбирается работа с ключевыми библиотеками для обработки и визуализации данных: NumPy, Pandas, SciPy, Scikit-learn и Seaborn. Вы научитесь находить корреляции, сегментировать выборки и очищать данные от дубликатов с помощью специализированных модулей Python.

Материал ориентирован на разработчиков, которые уже знают Python и хотят перейти к профессиональной работе с аналитикой и большими данными. После завершения курса вы сможете самостоятельно проводить глубокий статистический анализ и переводить сырые показатели в визуально понятные отчеты.

Программа обучения

  • Подготовка данных: очистка от дубликатов и фильтрация
  • Сегментация данных для анализа
  • Поиск и расчет корреляций
  • Визуализация результатов анализа
  • Использование библиотек:
    • NumPy и Pandas для математических вычислений
    • SciPy для статистических расчетов
    • Matplotlib и Seaborn для визуализации
    • Cufflinks для интерактивных графиков
    • Scikit-learn для базовой аналитики
    • Дополнительные модули: re, mailbox, csv, datetime, pylab, ipywidgets, IPython
Складчина создана 11 июля 2021 г. · описание обновлено 23 марта 2026 г.

Другие материалы автора 3

HK Helen Kapatsa Все материалы
142 ₽ 999 ₽