Ćwiczenie z odczytywania planów zapytań 2
Dostępne są trzy ramki danych: part2_df, part3_df i part4_df. Odpowiedzi na pytania w tym ćwiczeniu można znaleźć, analizując wynik explain() każdej z tych ramek danych.
Zwróć uwagę, że Spark oznacza każdą nazwę kolumny deskryptorem oddzielonym symbolem #. Na przykład: word#0, id#1L, part#2 i title#3. Na potrzeby tego ćwiczenia możesz pominąć te deskryptory.
To ćwiczenie jest częścią kursu
Wprowadzenie do Spark SQL w Pythonie
Interaktywne ćwiczenie praktyczne
Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń
Rozpocznij ćwiczenie