Kom igångKom igång gratis

Gruppera värden i intervall

För många kontinuerliga värden är det exakta värdet i en numerisk kolumn mindre viktigt – det som spelar roll är vilket intervall värdet faller i. Det här kan vara användbart när du visualiserar data eller förenklar dina maskininlärningsmodeller. Metoden används framför allt på kontinuerliga variabler där hög precision inte är avgörande, till exempel ålder, längd och lön.

Intervall skapas med pd.cut(df['column_name'], bins), där bins antingen är ett heltal som anger antalet jämnt fördelade intervall, eller en lista med intervallgränser.

Den här övningen är en del av kursen

Särdragshantering för maskininlärning i Python

Visa kurs

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Bin the continuous variable ConvertedSalary into 5 bins
so_survey_df['equal_binned'] = ____(so_survey_df['ConvertedSalary'], ____)

# Print the first 5 rows of the equal_binned column
print(so_survey_df[['equal_binned', 'ConvertedSalary']].head())
Redigera och kör kod