Spark, Hadoop et Hive
Vous avez découvert plusieurs projets libres dans la vidéo précédente : Hadoop, Hive et PySpark. Il est facile de les confondre.
Ils ont des points communs : ils sont tous actuellement maintenus par la Apache Software Foundation et ont tous servi au traitement massivement parallèle. Saurez-vous repérer les différences ?
Cette activité fait partie du cours
Introduction à l'ingénierie des données
Exercice interactif pratique
Passez de la théorie à l’action grâce à l’un de nos exercices interactifs
Commencer l’exercice