НачатьНачать бесплатно

Методы разбиения на чанки

Чанк — это отдельная точка данных в результатах мониторинга. Напомним, что существует три метода разбиения данных на чанки: по времени, по размеру и по количеству чанков.

В этом упражнении вы разобьёте данные на чанки и визуализируете результаты алгоритма CBPE для набора данных US Census, используя методы разбиения по размеру и по количеству.

Библиотека nannyml уже импортирована.

Это упражнение является частью курса

Мониторинг машинного обучения на Python

Посмотреть курс

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

reference, analysis, analysis_gt = ____.____()

# Initialize the CBPE algorithm
cbpe = nannyml.CBPE(
    y_pred_proba='predicted_probability',
    y_pred='prediction',
    y_true='employed',
    metrics = ['roc_auc', 'accuracy'],
    problem_type = 'classification_binary',
    ____ = ____,
)

cbpe = cbpe.fit(reference)
estimated_results = cbpe.estimate(analysis)
estimated_results.plot().show()
Редактировать и запускать код