Spark, Hadoop och Hive
Du har stött på flera open source-projekt i det föregående videoavsnittet: Hadoop, Hive och PySpark. Det är lätt att blanda ihop dem.
De har några saker gemensamt: de underhålls alla av Apache Software Foundation och har alla använts för massiv parallellbearbetning. Kan du se skillnaderna?
Den här övningen är en del av kursen
Introduktion till datatekniker
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen