Ultimate Web Scraping With Python Bootcamp

25 участников

О чём курс

Веб-скрейпинг позволяет превратить любой сайт в структурированный источник данных — от автоматической выгрузки изображений в высоком разрешении до обхода сложных динамических страниц. Внутри разбирается работа с протоколом HTTP, архитектура современных веб-ресурсов и использование Python для создания собственных парсеров.

Основные темы и инструменты:

  • Работа с динамическим контентом через Microsoft Playwright: автоматизация браузера для сбора данных, которые подгружаются через JavaScript.
  • Эмуляция API-запросов: методы извлечения данных с сайтов, где нет официального публичного API.
  • Обход ограничений: настройка прокси и использование пользовательских заголовков для получения доступа к контенту, скрытому за paywall.
  • Библиотеки и парсинг: глубокое погружение в requests и BeautifulSoup для разбора HTML/CSS структуры страниц.

Курс рассчитан на новичков в Python, которые хотят освоить навыки программного сбора и обработки данных. По итогу вы научитесь создавать автономных агентов для парсинга, способных собирать нужную информацию с любых веб-ресурсов.

Программа обучения

  • Часть I: Начало
    • Обзор цикла запрос-ответ
    • Работа с пользовательскими агентами, глаголами HTTP и заголовками
    • Обход платных доступов с помощью заголовков
    • Библиотека requests для HTTP-запросов
    • Основы безгражданства (stateless) и файлы cookie
    • Роль прокси в веб-архитектуре
    • Использование BeautifulSoup для парсинга данных
  • Часть II: Уточнение
    • Парсинг динамических веб-сайтов
    • Использование Microsoft Playwright (headless browser)
    • Эмуляция API-вызовов для скрытых данных
    • Проект: парсер изображений по ключевым словам
    • Проект: агент для автоматизированного сбора контента
Складчина создана 28 марта 2023 г. · описание обновлено 23 марта 2026 г.
136 ₽ 930 ₽