Proč záleží na explicitních schématech
Ty i tvůj kolega ve Global Retail Analytics načtete soubor customer_orders.csv a spustíte stejný čisticí pipeline, ale dostanete různé výsledky. Obrázek ukazuje oba přístupy vedle sebe.
Jaká je nejpravděpodobnější příčina rozdílu v počtu řádků?
Toto cvičení je součástí kurzu
Transformace dat pomocí Spark SQL v Databricks
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení