Парсинг сайтов Python

42 участника

О чём курс

Вам нужен автоматический сбор данных с веб-ресурсов или бот, имитирующий действия реального пользователя — этот материал закрывает обе задачи с помощью Python. Вы перестанете ограничиваться простым скачиванием контента и научитесь полноценно взаимодействовать с сайтами: от авторизации в личном кабинете до обхода блокировок через подмену User-Agent и сессий.

Внутри разбираются ключевые инструменты: библиотека requests для управления HTTP-запросами, Beautiful Soup 4 для извлечения данных из HTML, а также методы многопроцессорной обработки для ускорения работы программ. Отдельный фокус сделан на понимании архитектуры клиент-сервер и работы протоколов, что критически важно для написания стабильных парсеров.

Курс рассчитан на тех, кто уже знает основы Python и хочет применять их для автоматизации рутинных задач или выполнения заказов на фрилансе.

Программа обучения

  • Раздел 1
    • Работа с библиотекой requests
    • Извлечение данных со страницы
    • GET и POST запросы, headers, data
    • Создание сессий и управление куки
    • Архитектура клиент-сервер и HTTP-протокол
    • Парсинг всех страниц сайта
    • Многопроцессорная обработка (multiprocessing)
    • Подмена User-Agent
  • Раздел 2
    • Основы Beautiful Soup 4 (bs4)
    • Практика: извлечение IP-адреса
    • Практика: скачивание файлов с сайта
    • Практика: создание программы с использованием multiprocessing
Складчина создана 4 июня 2021 г. · описание обновлено 23 марта 2026 г.

Другие материалы автора 6

НХ Никита Хохлов Все материалы
94 ₽ 999 ₽