НачатьНачать бесплатно

Изучение набора данных UCI SECOM

Чтобы завершить эту главу и закрепить понимание бэггинга, пора поработать с новым набором данных! Он получен из репозитория UCI Machine Learning Repository и описывает процесс производства полупроводников.

Каждая строка представляет один производственный объект. Признаки — это показания датчиков или контрольных точек процесса. Метки указывают, прошёл ли объект проверку (1) или нет (-1).

Набор данных загружен и доступен вам как uci_secom. Переменная target соответствует столбцу 'Pass/Fail'. Используйте методы .value_counts() и .describe(), чтобы изучить эту переменную. Что вы заметите?

Это упражнение является частью курса

Ансамблевые методы в Python

Посмотреть курс

Практическое интерактивное упражнение

Превратите теорию в практику с помощью одного из наших интерактивных упражнений

Начать упражнение