Spark, Hadoop și Hive
Ai întâlnit destul de multe proiecte open source în videoclipul anterior: Hadoop, Hive și PySpark. E ușor să te încurci între ele.
Au câteva lucruri în comun: toate sunt menținute în prezent de Apache Software Foundation și toate au fost folosite pentru procesare paralelă masivă. Poți identifica diferențele dintre ele?
Acest exercițiu face parte din cursul
Introducere în Data Engineering
Exercițiu interactiv practic
Transformă teoria în practică cu unul dintre exercițiile noastre interactive
Începe exercițiul