Waarom expliciete schema's belangrijk zijn
Jij en een collega bij Global Retail Analytics laden allebei customer_orders.csv en draaien dezelfde schoonmaakpipeline, maar krijgen verschillende resultaten. De afbeelding laat beide aanpakken naast elkaar zien.
Wat is de meest waarschijnlijke oorzaak van het verschil in aantal rijen?
Deze oefening maakt deel uit van de cursus
Gegevens transformeren met Spark SQL in Databricks
Interactieve oefening met praktijkervaring
Zet theorie om in actie met een van onze interactieve oefeningen
Begin oefening