Загрузка набора данных
В состав NannyML входит набор встроенных наборов данных, которые упрощают демонстрацию сценариев использования и тестирование различных алгоритмов. Чтобы загрузить данные, достаточно вызвать функцию nannyml.load_us_census_ma_employment_data().
Функция возвращает три объекта Pandas DataFrame: референсный набор (тестовая выборка), набор для анализа (новые производственные данные) и эталонные метки для набора анализа. Этим объектам следует присвоить имена в соответствии с принятым соглашением: reference, analysis и analysis_gt.
В этом упражнении вы загрузите набор данных о занятости населения из переписи США и выведете на экран содержимое наборов данных, чтобы ознакомиться с их структурой.
Это упражнение является частью курса
Мониторинг машинного обучения на Python
Инструкции к упражнению
- Импортируйте библиотеку
nannyml. - Загрузите набор данных о занятости населения из переписи США из библиотеки
nannyml. - Выведите первые строки референсного набора данных.
- Выведите первые строки набора данных для анализа.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Import nannyml
import ____
# Load US Census Employment dataset
____, ____, ____ = ____.____()
# Print head of the reference data
____
# Print head of the analysis data
____