EmpezarEmpieza gratis

Explorando los datos de UCI SECOM

Para cerrar este capítulo y afianzar lo que has aprendido sobre bagging, ¡vamos a trabajar con un nuevo conjunto de datos! Estos datos provienen de un proceso de fabricación de semiconductores y se obtuvieron del UCI Machine Learning Repository.

Cada fila representa una entidad de producción. Las variables son mediciones de sensores o puntos del proceso. Las etiquetas indican si la entidad aprueba (1) o falla (-1) la prueba.

El conjunto de datos ya está cargado y disponible como uci_secom. La variable target es la columna 'Pass/Fail'. Usa los métodos .value_counts() y .describe() para inspeccionar esta variable. ¿Qué observas?

Este ejercicio forma parte del curso

Ensemble Methods in Python

Ver curso

ejercicio interactivo práctico

Convierte la teoría en práctica con uno de nuestros ejercicios interactivos

Empezar ejercicio