CommencezCommencez gratuitement

S'exercer à lire des plans de requête 2

Trois DataFrames sont disponibles : part2_df, part3_df et part4_df. Les questions de cet exercice peuvent être résolues en inspectant la sortie de explain() pour chaque DataFrame.

Notez que Spark annote chaque nom de colonne avec un descripteur, délimité par le symbole #. Par exemple, word#0, id#1L, part#2 et title#3. Pour les besoins de cet exercice, vous pouvez ignorer ces descripteurs.

Cette activité fait partie du cours

Introduction à Spark SQL en Python

Voir le cours

Exercice interactif pratique

Passez de la théorie à l’action grâce à l’un de nos exercices interactifs

Commencer l’exercice