Začněte nyníZačněte zdarma

Čtení query plánů 2 – procvičování

K dispozici jsou tři dataframy: part2_df, part3_df a part4_df. Na otázky v tomto cvičení můžeš odpovědět prozkoumáním výstupu explain() každého dataframu.

Všimni si, že Spark označuje každý název sloupce deskriptorem oddělený symbolem #. Například word#0, id#1L, part#2 a title#3. Pro účely tohoto cvičení tyto deskriptory ignoruj.

Toto cvičení je součástí kurzu

Úvod do Spark SQL v Pythonu

Zobrazit kurz

Interaktivní praktické cvičení

Proměňte teorii v praxi s jedním z našich interaktivních cvičení

Začít cvičení