Remplir les valeurs manquantes avec pandas
Lors de la création de pipelines de données, vous tomberez inévitablement sur des données manquantes. Dans certains cas, vous pouvez vouloir retirer ces enregistrements de l'ensemble de données. Mais dans d'autres, vous devrez imputer des valeurs pour l'information manquante. Dans cet exercice, vous pratiquerez l'utilisation de pandas pour imputer des résultats de tests manquants.
Les données du fichier "testing_scores.json" ont été lues dans un DataFrame et sont stockées dans la variable raw_testing_scores. De plus, pandas a été importé sous le nom pd.
Cette activité fait partie du cours
ETL et ELT en Python
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Print the head of the `raw_testing_scores` DataFrame
print(raw_testing_scores.____)