Eksploracja zbioru danych UCI SECOM
Na zakończenie tego rozdziału i utrwalenie wiedzy o baggingu czas poznać nowy zbiór danych! Dane pochodzą z procesu produkcji półprzewodników i zostały pobrane z repozytorium UCI Machine Learning Repository.
Każdy wiersz reprezentuje jeden element produkcyjny. Cechy to pomiary z czujników lub punktów kontrolnych procesu. Etykiety wskazują, czy element przeszedł (1) czy nie przeszedł (-1) testu.
Zbiór danych jest wczytany i dostępny jako uci_secom. Zmienna target odpowiada kolumnie 'Pass/Fail'. Użyj metod .value_counts() i .describe(), aby zbadać tę zmienną. Co zauważasz?
To ćwiczenie jest częścią kursu
Metody zespołowe w Pythonie
Interaktywne ćwiczenie praktyczne
Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń
Rozpocznij ćwiczenie