Изучение набора данных UCI SECOM
Чтобы завершить эту главу и закрепить понимание бэггинга, пора поработать с новым набором данных! Он получен из репозитория UCI Machine Learning Repository и описывает процесс производства полупроводников.
Каждая строка представляет один производственный объект. Признаки — это показания датчиков или контрольных точек процесса. Метки указывают, прошёл ли объект проверку (1) или нет (-1).
Набор данных загружен и доступен вам как uci_secom. Переменная target соответствует столбцу 'Pass/Fail'. Используйте методы .value_counts() и .describe(), чтобы изучить эту переменную. Что вы заметите?
Это упражнение является частью курса
Ансамблевые методы в Python
Практическое интерактивное упражнение
Превратите теорию в практику с помощью одного из наших интерактивных упражнений
Начать упражнение