Zacznij terazZacznij za darmo

Ćwiczenie z odczytywania planów zapytań 2

Dostępne są trzy ramki danych: part2_df, part3_df i part4_df. Odpowiedzi na pytania w tym ćwiczeniu można znaleźć, analizując wynik explain() każdej z tych ramek danych.

Zwróć uwagę, że Spark oznacza każdą nazwę kolumny deskryptorem oddzielonym symbolem #. Na przykład: word#0, id#1L, part#2 i title#3. Na potrzeby tego ćwiczenia możesz pominąć te deskryptory.

To ćwiczenie jest częścią kursu

Wprowadzenie do Spark SQL w Pythonie

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń

Rozpocznij ćwiczenie