Een pijplijn met meerdere taken bouwen
Je team bij Global Retail Analytics heeft de datapijplijn opgesplitst in drie notebooks: task1_ingest maakt de ruwe CSV schoon en schrijft een Delta-tabel, task2_revenue aggregeert omzet per land, en task3_top_customers rangschikt klanten op basis van bestedingen. Alle drie zijn vooraf geladen in de map Exercises.
Jouw taak is om ze aan elkaar te koppelen in een Databricks Job, de pijplijn uit te voeren en eventuele fouten op te lossen die naar voren komen.
Deze oefening maakt deel uit van de cursus
Gegevens transformeren met Spark SQL in Databricks
Interactieve oefening met praktijkervaring
Zet theorie om in actie met een van onze interactieve oefeningen
Begin oefening