Spark, Hadoop a Hive
V předchozím videu jsi narazil/a na několik open source projektů: Hadoop, Hive a PySpark. Snadno se v nich lze ztratit.
Mají pár věcí společných: všechny jsou v současnosti spravovány Apache Software Foundation a všechny se používají pro masivní paralelní zpracování dat. Dokážeš ale najít jejich rozdíly?
Toto cvičení je součástí kurzu
Introduction to Data Engineering
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení