加载数据集
NannyML 自带一组内部数据集,便于演示用例并测试不同算法。要加载数据集,您只需使用函数 nannyml.load_us_census_ma_employment_data()。
该函数会返回 3 个 Pandas 的 DataFrame 对象:参考集(测试集)、分析集(未见的生产数据)以及分析集的真实标签。请按约定将这些数据框命名为 reference、analysis 和 analysis_gt。
在本练习中,您将加载 US Census Employment 数据集,并打印这些数据框,以了解其结构和内容。
本练习是课程的一部分
Python 中的机器学习监控
练习说明
- 导入
nannyml库。 - 从
nannyml库加载 US Census Employment 数据集。 - 打印参考数据的表头。
- 打印分析数据的表头。
交互式实操练习
通过完成这段示例代码来试试这个练习。
# Import nannyml
import ____
# Load US Census Employment dataset
____, ____, ____ = ____.____()
# Print head of the reference data
____
# Print head of the analysis data
____