CommencerCommencez gratuitement

Affichage des tables

Une fois que vous avez créé un SparkSession, vous pouvez commencer à explorer pour voir quelles données se trouvent dans votre cluster.

Votre SparkSession dispose d'un attribut appelé catalog qui répertorie toutes les données contenues dans le cluster. Cet attribut dispose de plusieurs méthodes permettant d'extraire différentes informations.

L'une des méthodes les plus utiles est la méthode .listTables(), qui renvoie les noms de toutes les tables de votre cluster sous forme de liste.

Cet exercice fait partie du cours

<cours>Principes fondamentaux de PySpark</cours>
Voir le cours

Instructions de l’exercice

  • Veuillez consulter les tables présentes dans votre cluster en appelant spark.catalog.listTables() et en affichant le résultat.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Print the tables in the catalog
print(spark.____.____())
Modifier et exécuter le code