or
Acest exercițiu face parte din cursul
În acest capitol, vei învăța să lucrezi cu notebook-uri Databricks, să încarci date CSV în Spark DataFrames și să modelezi date folosind PySpark și SQL.
Vei învăța să definești scheme explicite, să construiești un pipeline de curățare a datelor și să optimizezi performanța interogărilor cu broadcast joins.
Vei învăța să calculezi totaluri cumulative și clasamente cu funcții de fereastră, să construiești pipeline-uri de streaming și să implementezi fluxuri de lucru în producție.
Exercițiul curent