CommencezCommencez gratuitement

Charger l'ensemble de données

NannyML propose un ensemble de jeux de données internes pour faciliter la démonstration de cas d'utilisation et le test de différents algorithmes. Pour charger l'ensemble de données, vous n'avez qu'à utiliser la fonction nannyml.load_us_census_ma_employment_data().

La fonction renvoie trois objets DataFrame de Pandas : l'ensemble de référence (l'ensemble de test), l'ensemble d'analyse (données en production non vues) et la vérité terrain pour l'ensemble d'analyse. Nommez ces trames de données selon la convention reference, analysis et analysis_gt.

Dans cet exercice, vous allez charger l'ensemble de données US Census Employment et afficher les trames de données pour voir à quoi elles ressemblent.

Cette activité fait partie du cours

Surveiller le Machine Learning en Python

Voir le cours

Instructions de l’exercice

  • Importez la bibliothèque nannyml.
  • Chargez l'ensemble de données US Census Employment à partir de la bibliothèque nannyml.
  • Affichez les premières lignes des données de référence.
  • Affichez les premières lignes des données d'analyse.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Import nannyml
import ____

# Load US Census Employment dataset
____, ____, ____ = ____.____()

# Print head of the reference data
____

# Print head of the analysis data
____
Modifier et exécuter le code