Spark, Hadoop и Hive
В предыдущем видео вы познакомились с несколькими проектами с открытым исходным кодом: Hadoop, Hive и PySpark. В этих проектах легко запутаться.
У них есть кое-что общее: все они поддерживаются Apache Software Foundation и используются для массовой параллельной обработки данных. Попробуйте найти различия между ними.
Это упражнение является частью курса
Введение в дата-инжиниринг
Практическое интерактивное упражнение
Превратите теорию в практику с помощью одного из наших интерактивных упражнений
Начать упражнение