or
Den här övningen är en del av kursen
I det här kapitlet lär du dig vad det faktiskt innebär att förbehandla data. Du tar de första stegen i varje förbehandlingsprocess, bland annat att utforska datatyper och hantera saknade värden.
Det här kapitlet handlar om standardisering av data. En modell utgår ofta från vissa antaganden om fördelningen eller skalan hos dina särdrag. Standardisering är ett sätt att anpassa dina data till dessa antaganden och förbättra algoritmens prestanda.
I det här avsnittet lär du dig om särdragshantering. Du utforskar olika sätt att skapa nya och mer användbara särdrag utifrån de som redan finns i din datamängd. Du ser hur du kodar, aggregerar och extraherar information från både numeriska och textbaserade särdrag.
Det här kapitlet går igenom några olika tekniker för att välja ut de viktigaste särdragen från din datamängd. Du lär dig att ta bort redundanta särdrag, arbeta med textvektorer och minska antalet särdrag med hjälp av principalkomponentanalys (PCA).
Nu när du har lärt dig allt om förbehandling får du prova teknikerna på en datamängd som innehåller information om UFO-observationer.
Aktuell övning