CommencezCommencez gratuitement

Créer un pipeline de travail à tâches multiples

Votre équipe chez Global Retail Analytics a divisé le pipeline de données en trois carnets : task1_ingest nettoie le CSV brut et écrit une table Delta, task2_revenue agrège les revenus par pays, et task3_top_customers classe les clients selon leurs dépenses. Les trois sont déjà chargés dans le dossier Exercises.

Votre rôle est de les relier dans un Job Databricks, d'exécuter le pipeline et de corriger toute erreur qui survient.

Cette activité fait partie du cours

Transformation des données avec Spark SQL dans Databricks

Voir le cours

Exercice interactif pratique

Passez de la théorie à l’action grâce à l’un de nos exercices interactifs

Commencer l’exercice