Spark, Hadoop і Hive
У попередньому відео ви побачили чимало проєктів з відкритим кодом: Hadoop, Hive і PySpark. Легко заплутатися між цими проєктами.
У них є дещо спільне: усі вони зараз підтримуються Apache Software Foundation і всі використовувалися для масового паралельного оброблення. Чи зможете ви помітити відмінності?
Ця вправа є частиною курсу
Вступ до Data Engineering
Практична інтерактивна вправа
Перетворіть теорію на практику за допомогою однієї з наших інтерактивних вправ
Почати вправу