Dlaczego jawne schematy mają znaczenie
Ty i twój kolega z Global Retail Analytics wczytywacie ten sam plik customer_orders.csv i uruchamiacie ten sam potok czyszczenia danych, ale otrzymujecie różne wyniki. Na obrazku widać oba podejścia obok siebie.
Jaka jest najbardziej prawdopodobna przyczyna rozbieżności w liczbie wierszy?
To ćwiczenie jest częścią kursu
Data Transformation with Spark SQL in Databricks
Interaktywne ćwiczenie praktyczne
Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń
Rozpocznij ćwiczenie