Веб-парсинг на Python с BeautifulSoup и Selenium

33 участника

О чём курс

Одно YouTube-видео раньше требовало 1–2 недели работы — здесь показывают, как сократить это до пары часов с помощью AI-инструментов CapCut. (Примечание: описание курса сфокусировано на сборе данных с веб-ресурсов). Вы научитесь извлекать информацию с динамических страниц, которые используют JavaScript, а также автоматизировать процесс обновления данных. Внутри разбираются пять практических проектов на примере крупных площадок вроде Airbnb, Twitter и Google. Вы освоите работу с HTML-селекторами, XPath, библиотеками BeautifulSoup и Selenium для обхода сложных структур сайтов. В результате вы сможете создавать собственных ботов-парсерров, которые работают по расписанию и собирают данные с любого ресурса в сети.

Программа обучения

  • Модуль 1: Основы веб-парсинга и подготовка окружения
  • Модуль 2: BeautifulSoup и библиотека запросов (Requests)
    • Использование LXML-анализатора
    • Извлечение данных из таблиц
    • Парсинг многостраничных ресурсов
  • Модуль 3: Selenium для динамических веб-страниц
    • Взаимодействие с элементами (кнопки, поля ввода)
    • Управление самопрокруткой страниц
    • Обработка JavaScript-событий
  • Модуль 4: Интеграция BeautifulSoup и Selenium для сложных сайтов
  • Модуль 5: Автоматизация скриптов
    • Настройка запуска парсеров по расписанию
Складчина создана 10 января 2021 г. · описание обновлено 23 марта 2026 г.
112 ₽ 999 ₽