Быстрые и доступные VPS/VDS-серверы

Мы создаем основу для вашего успеха: сверхбыстрые серверы, непрерывная стабильность и разумные цены!

Смотреть тарифы

Промокод promo_34043

Быстрые и доступные VPS/VDS-серверы

 

Hadoop. Spark

defaultValue

Техносфера Mail.ru Group, МГУ им. М.В. Ломоносова.
Курс "Методы распределенной обработки больших объемов данных в Hadoop"
Лекция №12 "Spark"
Лектор - Алексей Романенко.


Мотивация. RDD. Программная модель Spark. Higher-Order Functions. Трансформация RDD (Map, Reduce, Join, CoGroup, Union и Sample). RDD actions. SparkContext. Создание RDD. Общие переменные (broadcast, accumulator). Движок Apache Spark. Программный интерфейс Spark. Lineage. Зависимости между RDD (Narrow, Wide). Расписание задач. Отказоустойчивость RDD. Управление памятью. Приложения, которые подходят и не подходят для RDD.

defaultValue

Видеотека

-->

Яндекс.Метрика