Pourquoi les schémas explicites sont importants
Vous et une collègue chez Global Retail Analytics chargez tous deux customer_orders.csv et exécutez le même pipeline de nettoyage, mais vous obtenez des résultats différents. L'image montre les deux approches côte à côte.
Quelle est la cause la plus probable de l'écart dans le nombre de lignes ?
Cette activité fait partie du cours
Transformation des données avec Spark SQL dans Databricks
Exercice interactif pratique
Passez de la théorie à l’action grâce à l’un de nos exercices interactifs
Commencer l’exercice