Utforska UCI SECOM-data
För att avsluta det här kapitlet och befästa din förståelse av bagging är det dags att arbeta med ett nytt dataset! Data kommer från en halvledarproduktionsprocess och är hämtad från UCI Machine Learning Repository.
Varje rad representerar en produktionsenhet. Särdragen är mätningar från sensorer eller punkter i processen. Etiketterna anger om enheten godkänns (1) eller underkänns (-1) i testet.
Datasetet är inläst och tillgängligt som uci_secom. Variabeln target är kolumnen 'Pass/Fail'. Använd metoderna .value_counts() och .describe() för att undersöka den här variabeln. Vad lägger du märke till?
Den här övningen är en del av kursen
Ensemblemetoder i Python
Interaktiv övning med praktiskt arbete
Gör teori till handling med en av våra interaktiva övningar
Starta övningen