Detekce chybějících hodnot
Datasety často obsahují chybějící hodnoty skryté za zástupnými řetězci jako 'NA', '.' nebo jinými. V tomto cvičení budeš pracovat s datasetem college, který obsahuje různé údaje o vysokoškolských studentech. Tvým úkolem je identifikovat chybějící hodnoty analýzou tohoto datasetu.
K tomu využiješ metodu .info() z pandas a funkci sort() z numpy spolu s metodou .unique(), abys jasně odlišil/a zástupné hodnoty reprezentující chybějící data.
Soubor college.csv je již načtený. Balíčky numpy a pandas jsou importované jako np a pd.
Toto cvičení je součástí kurzu
Dealing with Missing Data in Python
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Read the dataset 'college.csv'
college = ___
print(college.head())