НачатьНачать бесплатно

Практика чтения планов запросов 2

Доступны три датафрейма: part2_df, part3_df и part4_df. На вопросы этого упражнения можно ответить, изучив вывод метода explain() для каждого датафрейма.

Обратите внимание: Spark помечает каждое имя столбца дескриптором, отделённым символом #. Например: word#0, id#1L, part#2, title#3. В рамках этого упражнения дескрипторы можно игнорировать.

Это упражнение является частью курса

Введение в Spark SQL на Python

Посмотреть курс

Практическое интерактивное упражнение

Превратите теорию в практику с помощью одного из наших интерактивных упражнений

Начать упражнение