Čtení query plánů 2 – procvičování
K dispozici jsou tři dataframy: part2_df, part3_df a part4_df. Na otázky v tomto cvičení můžeš odpovědět prozkoumáním výstupu explain() každého dataframu.
Všimni si, že Spark označuje každý název sloupce deskriptorem oddělený symbolem #. Například word#0, id#1L, part#2 a title#3. Pro účely tohoto cvičení tyto deskriptory ignoruj.
Toto cvičení je součástí kurzu
Úvod do Spark SQL v Pythonu
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení