Filtrage des données avec PySpark
Dans cet exercice, vous allez téléverser un fichier dans un lakehouse et utiliser PySpark pour filtrer des données. Le fichier contient une liste de jeux vidéo et leurs éditeurs. Nous voulons réduire l'ensemble de données pour ne traiter que les jeux vidéo de l'éditeur Atari.
Remarque : Si vous obtenez une erreur liée à une limite de débit d'API, cela survient généralement parce qu'une tâche Fabric précédente n'est pas terminée. Vous pouvez voir les tâches Fabric actives dans la page Monitor (située dans le menu vertical de gauche). L'annulation des anciennes tâches Fabric dans la page Monitor règle habituellement cette erreur de limite.
Cette activité fait partie du cours
Transformer et analyser des données avec Microsoft Fabric
Exercice interactif pratique
Passez de la théorie à l’action grâce à l’un de nos exercices interactifs
Commencer l’exercice