О чём курс

Работа с терабайтами и петабайтами данных требует инструментов, способных распределять нагрузку на тысячи узлов — именно для этого создана экосистема Apache Hadoop. На курсе вы разберете архитектуру распределенной обработки информации, которая лежит в основе высоконагруженных систем уровня Facebook.

Внутри программы — глубокое погружение в HDFS для хранения колоссальных объемов данных, настройка вычислительных кластеров и использование фреймворка MapReduce для управления распределенными задачами. Вы научитесь настраивать виртуальные среды для запуска приложений и освоите YARN для эффективного управления ресурсами. После обучения вы сможете проектировать и развертывать распределенные приложения, способные масштабироваться на любые объемы данных.

Программа обучения

  • Архитектура Hadoop
  • Распределенная файловая система HDFS
  • Классический MapReduce
  • Использование YARN
  • Экосистема проектов Hadoop
  • Практическая настройка виртуальных машин для запуска Hadoop-приложений
  • Разработка и запуск распределенного приложения на кластере
Складчина создана 9 декабря 2021 г. · описание обновлено 2 июня 2026 г.

Другие материалы автора 5

СШ Сергей Шуйков Все материалы
2 792 ₽ 23 450 ₽