Zacznij terazZacznij za darmo

Eksploracja zbioru danych UCI SECOM

Na zakończenie tego rozdziału i utrwalenie wiedzy o baggingu czas poznać nowy zbiór danych! Dane pochodzą z procesu produkcji półprzewodników i zostały pobrane z repozytorium UCI Machine Learning Repository.

Każdy wiersz reprezentuje jeden element produkcyjny. Cechy to pomiary z czujników lub punktów kontrolnych procesu. Etykiety wskazują, czy element przeszedł (1) czy nie przeszedł (-1) testu.

Zbiór danych jest wczytany i dostępny jako uci_secom. Zmienna target odpowiada kolumnie 'Pass/Fail'. Użyj metod .value_counts() i .describe(), aby zbadać tę zmienną. Co zauważasz?

To ćwiczenie jest częścią kursu

Metody zespołowe w Pythonie

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Przekształć teorię w praktykę dzięki jednemu z naszych interaktywnych ćwiczeń

Rozpocznij ćwiczenie