Načtení datasetu
NannyML obsahuje sadu interních datasetů, které usnadňují demonstraci různých případů použití a testování algoritmů. Pro načtení datasetu stačí zavolat funkci nannyml.load_us_census_ma_employment_data().
Funkce vrátí tři objekty Pandas DataFrame: referenční sadu (testovací sadu), analytickou sadu (nová produkční data) a skutečné hodnoty pro analytickou sadu. Tyto datové rámce pojmenuj podle konvence jako reference, analysis a analysis_gt.
V tomto cvičení načteš dataset US Census Employment a zobrazíš si datové rámce, abys pochopil/a, jak vypadají.
Toto cvičení je součástí kurzu
Monitoring Machine Learning in Python
Pokyny k cvičení
- Importuj knihovnu
nannyml. - Načti dataset US Census Employment z knihovny
nannyml. - Vypiš prvních několik řádků referenčních dat.
- Vypiš prvních několik řádků analytických dat.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Import nannyml
import ____
# Load US Census Employment dataset
____, ____, ____ = ____.____()
# Print head of the reference data
____
# Print head of the analysis data
____