Začněte nyníZačněte zdarma

Nahrazení chybějících hodnot

V předchozím cvičení jsi analyzoval/a dataset vysokých škol a zjistil/a, že '.' představuje chybějící hodnotu v datech. V tomto cvičení se naučíš, jak s takovými hodnotami správně pracovat pomocí modulu pandas.

Uvidíš, jak tyto hodnoty ošetřit při načítání CSV souboru do pandas pomocí funkce read_csv() a úpravou argumentu na_values, který ti umožňuje určit, co se má v DataFrame považovat za chybějící hodnotu.

Dataset byl načten jako college.csv. Knihovny pandas a numpy jsou již naimportovány jako pd a np.

Toto cvičení je součástí kurzu

Dealing with Missing Data in Python

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Read the dataset 'college.csv' with na_values set to '.'
college = pd.read_csv(___, ___)
print(college.head())
Upravit a spustit kód