Методы разбиения на чанки
Чанк — это отдельная точка данных в результатах мониторинга. Напомним, что существует три метода разбиения данных на чанки: по времени, по размеру и по количеству чанков.
В этом упражнении вы разобьёте данные на чанки и визуализируете результаты алгоритма CBPE для набора данных US Census, используя методы разбиения по размеру и по количеству.
Библиотека nannyml уже импортирована.
Это упражнение является частью курса
Мониторинг машинного обучения на Python
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
reference, analysis, analysis_gt = ____.____()
# Initialize the CBPE algorithm
cbpe = nannyml.CBPE(
y_pred_proba='predicted_probability',
y_pred='prediction',
y_true='employed',
metrics = ['roc_auc', 'accuracy'],
problem_type = 'classification_binary',
____ = ____,
)
cbpe = cbpe.fit(reference)
estimated_results = cbpe.estimate(analysis)
estimated_results.plot().show()