Kom igångKom igång gratis

Utforska UCI SECOM-data

För att avsluta det här kapitlet och befästa din förståelse av bagging är det dags att arbeta med ett nytt dataset! Data kommer från en halvledarproduktionsprocess och är hämtad från UCI Machine Learning Repository.

Varje rad representerar en produktionsenhet. Särdragen är mätningar från sensorer eller punkter i processen. Etiketterna anger om enheten godkänns (1) eller underkänns (-1) i testet.

Datasetet är inläst och tillgängligt som uci_secom. Variabeln target är kolumnen 'Pass/Fail'. Använd metoderna .value_counts() och .describe() för att undersöka den här variabeln. Vad lägger du märke till?

Den här övningen är en del av kursen

Ensemblemetoder i Python

Visa kurs

Interaktiv övning med praktiskt arbete

Gör teori till handling med en av våra interaktiva övningar

Starta övningen