or
Deze oefening maakt deel uit van de cursus
In dit hoofdstuk leer je werken met Databricks-notebooks, CSV-data laden in Spark DataFrames en data vormgeven met PySpark en SQL.
Leer hoe je expliciete schema's definieert, een opschoningspijplijn bouwt en de queryprestaties optimaliseert met broadcast joins.
Leer hoe je lopende totalen en rangordes berekent met windowfuncties, streamingpijplijnen bouwt en productie-workflows uitrolt.
Huidige oefening