Začněte nyníZačněte zdarma

Detekce chybějících hodnot

Datasety často obsahují chybějící hodnoty skryté za zástupnými řetězci jako 'NA', '.' nebo jinými. V tomto cvičení budeš pracovat s datasetem college, který obsahuje různé údaje o vysokoškolských studentech. Tvým úkolem je identifikovat chybějící hodnoty analýzou tohoto datasetu.

K tomu využiješ metodu .info() z pandas a funkci sort() z numpy spolu s metodou .unique(), abys jasně odlišil/a zástupné hodnoty reprezentující chybějící data.

Soubor college.csv je již načtený. Balíčky numpy a pandas jsou importované jako np a pd.

Toto cvičení je součástí kurzu

Dealing with Missing Data in Python

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Read the dataset 'college.csv'
college = ___
print(college.head())
Upravit a spustit kód