Explorarea setului de date UCI SECOM
Pentru a încheia acest capitol și a-ți consolida înțelegerea tehnicii de bagging, este timpul să lucrezi cu un set de date nou! Datele provin dintr-un proces de fabricație a semiconductoarelor, obținute din UCI Machine Learning Repository.
Fiecare rând reprezintă o entitate de producție. Caracteristicile sunt măsurători preluate de la senzori sau din diferite puncte ale procesului. Etichetele indică dacă entitatea respectivă trece (1) sau pică (-1) testul.
Setul de date este încărcat și disponibil ca uci_secom. Variabila target corespunde coloanei 'Pass/Fail'. Folosește metodele .value_counts() și .describe() pentru a analiza această variabilă. Ce observi?
Acest exercițiu face parte din cursul
Metode de ansamblu în Python
Exercițiu interactiv practic
Transformă teoria în practică cu unul dintre exercițiile noastre interactive
Începe exercițiul