Курс веб-парсинга на Python: BS4, Selenium и Scrapy

30 участников

О чём курс

Сбор данных с Amazon, Twitter, Google и других площадок — это критически важный навык для аналитика или разработчика, который превращает хаотичную информацию из сети в структурированные таблицы. Этот материал фокусируется на трех инструментах для автоматизации выгрузки данных, позволяя выбирать между простотой, гибкостью или высокой скоростью работы.

  • Beautiful Soup: основы извлечения данных из статических веб-страниц.
  • Selenium: парсинг динамических сайтов, использующих JavaScript для отрисовки контента.
  • Scrapy: создание высокопроизводительных пауков для быстрого сканирования крупных веб-ресурсов.

Программа построена по принципу практики: 10% времени уделено базе, 40% — Selenium и 50% — Scrapy. В результате вы научитесь создавать собственные веб-парсеры, способные обходить ограничения стандартных библиотек и собирать данные с любых интернет-ресурсов.

Программа обучения

  • Часть 1: Beautiful Soup (основы и легкое введение)
  • Часть 2: Selenium (парсинг сайтов на JavaScript)
  • Часть 3: Scrapy (масштабируемый парсинг и работа с Splash)
  • Практические проекты:
    • Сбор данных с Amazon Audible
    • Парсинг Twitter
    • Извлечение данных Google Search
    • Статистика Football Stats
    • Сбор информации с Worldometers
    • Работа с данными с Movie pages
Складчина создана 1 октября 2021 г. · описание обновлено 23 марта 2026 г.
134 ₽ 1 190 ₽