Začněte nyníZačněte zdarma

Proč záleží na explicitních schématech

Ty i tvůj kolega ve Global Retail Analytics načtete soubor customer_orders.csv a spustíte stejný čisticí pipeline, ale dostanete různé výsledky. Obrázek ukazuje oba přístupy vedle sebe.


Jaká je nejpravděpodobnější příčina rozdílu v počtu řádků?

Toto cvičení je součástí kurzu

Transformace dat pomocí Spark SQL v Databricks

Zobrazit kurz

Interaktivní praktické cvičení

Proměňte teorii v praxi s jedním z našich interaktivních cvičení

Začít cvičení