or
Den här övningen är en del av kursen
I det här kapitlet lär du dig att arbeta med Databricks-notebooks, läsa in CSV-data i Spark DataFrames och forma data med PySpark och SQL.
Lär dig att definiera explicita scheman, bygga en pipeline för datarensning och optimera frågeprestanda med broadcast joins.
Lär dig att beräkna löpande summor och rankningar med fönsterfunktioner, bygga strömningspipelines och driftsätta produktionsarbetsflöden.
Aktuell övning