Streamování maloobchodních dat do Delta Lake
Do sdíleného úložiště tvého týmu v Global Retail Analytics každý den přibývají nové soubory s objednávkami.
Místo toho, aby ses každé ráno načítalo všechno znovu, sestavíš streamovací pipeline, která automaticky zpracuje nové CSV soubory, zapíše je do Delta Lake a při restartu se spolehlivě obnoví díky checkpointům.
Toto cvičení je součástí kurzu
Transformace dat pomocí Spark SQL v Databricks
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení