Bygg en pipeline med flera uppgifter
Ditt team på Global Retail Analytics har delat upp datapipelinen i tre notebooks: task1_ingest rensar rådata från CSV och skriver en Delta-tabell, task2_revenue aggregerar intäkter per land, och task3_top_customers rangordnar kunder efter utgifter. Alla tre är förinlästa i mappen Exercises.
Din uppgift är att koppla ihop dem i ett Databricks-jobb, köra pipelinen och åtgärda eventuella fel.
Den här övningen är en del av kursen
Datatransformation med Spark SQL i Databricks
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen