Explorando los datos de UCI SECOM
Para cerrar este capítulo y afianzar lo que has aprendido sobre bagging, ¡vamos a trabajar con un nuevo conjunto de datos! Estos datos provienen de un proceso de fabricación de semiconductores y se obtuvieron del UCI Machine Learning Repository.
Cada fila representa una entidad de producción. Las variables son mediciones de sensores o puntos del proceso. Las etiquetas indican si la entidad aprueba (1) o falla (-1) la prueba.
El conjunto de datos ya está cargado y disponible como uci_secom. La variable target es la columna 'Pass/Fail'. Usa los métodos .value_counts() y .describe() para inspeccionar esta variable. ¿Qué observas?
Este ejercicio forma parte del curso
Ensemble Methods in Python
ejercicio interactivo práctico
Convierte la teoría en práctica con uno de nuestros ejercicios interactivos
Empezar ejercicio