О чём курс

Вам нужен рекламный ролик, YouTube-видео или контент для соцсетей — и всё это без съёмки и монтажной команды. Именно это собирают внутри, используя AI-функции CapCut.

Курс сфокусирован на создании надежной дата-архитектуры и проектировании пайплайнов для обработки данных. В процессе обучения вы освоите стек технологий для работы с потоками и хранилищами, включая Python, AirFlow, Kafka, Spark и ClickHouse. Программа строится вокруг выполнения финального проекта на собственных данных под руководством экспертов с опытом в проектировании систем для крупных компаний. Вы научитесь не просто управлять инструментами, а выстраивать полный жизненный цикл данных с учетом контроля их качества.

Программа обучения

    1. Введение.
    1. Python и терминал для задач Data Engineering.
    • Установочная сессия.
    1. Распределенные файловые системы. Hadoop. Map-Reduce.
    1. Spark for Data Engineering.
    • Встреча по темам 2-4.
    1. Реляционные базы данных.
    1. NOSQL базы данных и введение в методологии построения хранилищ.
    1. Процессинг и перекладывание (перекладка) данных.
    1. Оркестраторы данных. AirFlow.
    • Встреча по темам 5-8.
    1. Шины данных. Kafka. Принципы построения систем потоковой аналитики.
    1. ETL-инструменты. NiFi.
    1. Архитектура хранилищ данных.
    1. Аналитика. Жизненный цикл данных и оценка data quality.
    • Встреча по темам 9-12.
    1. Работа с собственным проектом в финальном модуле.
    1. Заключение
Складчина создана 14 июня 2024 г. · описание обновлено 23 марта 2026 г.
4 000 ₽ 80 000 ₽