Retaildata streamen naar Delta Lake
Elke dag komen er nieuwe orderbestanden binnen in de volume van je team bij Global Retail Analytics.
In plaats van elke ochtend alles opnieuw te laden, bouw je een streamingpipeline die nieuwe CSV-bestanden automatisch oppikt, ze naar Delta Lake wegschrijft en dankzij checkpoints zonder problemen herstartingen opvangt.
Deze oefening maakt deel uit van de cursus
Gegevens transformeren met Spark SQL in Databricks
Interactieve oefening met praktijkervaring
Zet theorie om in actie met een van onze interactieve oefeningen
Begin oefening