НачатьНачать бесплатно

Spark, Hadoop и Hive

В предыдущем видео вы познакомились с несколькими проектами с открытым исходным кодом: Hadoop, Hive и PySpark. В этих проектах легко запутаться.

У них есть кое-что общее: все они поддерживаются Apache Software Foundation и используются для массовой параллельной обработки данных. Попробуйте найти различия между ними.

Это упражнение является частью курса

Введение в дата-инжиниринг

Посмотреть курс

Практическое интерактивное упражнение

Превратите теорию в практику с помощью одного из наших интерактивных упражнений

Начать упражнение