Charger l'ensemble de données
NannyML propose un ensemble de jeux de données internes pour faciliter la démonstration de cas d'utilisation et le test de différents algorithmes. Pour charger l'ensemble de données, vous n'avez qu'à utiliser la fonction nannyml.load_us_census_ma_employment_data().
La fonction renvoie trois objets DataFrame de Pandas : l'ensemble de référence (l'ensemble de test), l'ensemble d'analyse (données en production non vues) et la vérité terrain pour l'ensemble d'analyse. Nommez ces trames de données selon la convention reference, analysis et analysis_gt.
Dans cet exercice, vous allez charger l'ensemble de données US Census Employment et afficher les trames de données pour voir à quoi elles ressemblent.
Cette activité fait partie du cours
Surveiller le Machine Learning en Python
Instructions de l’exercice
- Importez la bibliothèque
nannyml. - Chargez l'ensemble de données US Census Employment à partir de la bibliothèque
nannyml. - Affichez les premières lignes des données de référence.
- Affichez les premières lignes des données d'analyse.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import nannyml
import ____
# Load US Census Employment dataset
____, ____, ____ = ____.____()
# Print head of the reference data
____
# Print head of the analysis data
____