Diffuser des données de vente au détail vers Delta Lake
De nouveaux fichiers de commandes arrivent chaque jour dans le volume de votre équipe chez Global Retail Analytics.
Plutôt que de tout recharger chaque matin, vous allez créer un pipeline de diffusion en continu qui capte automatiquement les nouveaux fichiers CSV, les écrit dans Delta Lake et se rétablit correctement après un redémarrage grâce aux points de contrôle (checkpoints).
Cette activité fait partie du cours
Transformation des données avec Spark SQL dans Databricks
Exercice interactif pratique
Passez de la théorie à l’action grâce à l’un de nos exercices interactifs
Commencer l’exercice