Aan de slagBegin gratis

Een pijplijn met meerdere taken bouwen

Je team bij Global Retail Analytics heeft de datapijplijn opgesplitst in drie notebooks: task1_ingest maakt de ruwe CSV schoon en schrijft een Delta-tabel, task2_revenue aggregeert omzet per land, en task3_top_customers rangschikt klanten op basis van bestedingen. Alle drie zijn vooraf geladen in de map Exercises.

Jouw taak is om ze aan elkaar te koppelen in een Databricks Job, de pijplijn uit te voeren en eventuele fouten op te lossen die naar voren komen.

Deze oefening maakt deel uit van de cursus

Gegevens transformeren met Spark SQL in Databricks

Bekijk cursus

Interactieve oefening met praktijkervaring

Zet theorie om in actie met een van onze interactieve oefeningen

Begin oefening