Kom igångKom igång gratis

Hur ser dina data ut? (I)

Hittills har du fokuserat på att skapa nya särdrag och hantera problem i dina data. Feature engineering kan också användas för att få ut mer av de data du redan har och använda dem mer effektivt när du bygger maskininlärningsmodeller.
Många algoritmer utgår från att dina data är normalfördelade, eller åtminstone att alla kolumner är på samma skala. Så är det ofta inte – ett särdrag kan till exempel mätas i tusental dollar medan ett annat representerar antal år. I den här övningen skapar du diagram för att undersöka fördelningarna hos några numeriska kolumner i DataFrame:en so_survey_df, som lagrats i so_numeric_df.

Den här övningen är en del av kursen

Särdragshantering för maskininlärning i Python

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create a histogram
____
plt.show()
Redigera och kör kod