Nahrazení chybějících hodnot
V předchozím cvičení jsi analyzoval/a dataset vysokých škol a zjistil/a, že '.' představuje chybějící hodnotu v datech. V tomto cvičení se naučíš, jak s takovými hodnotami správně pracovat pomocí modulu pandas.
Uvidíš, jak tyto hodnoty ošetřit při načítání CSV souboru do pandas pomocí funkce read_csv() a úpravou argumentu na_values, který ti umožňuje určit, co se má v DataFrame považovat za chybějící hodnotu.
Dataset byl načten jako college.csv. Knihovny pandas a numpy jsou již naimportovány jako pd a np.
Toto cvičení je součástí kurzu
Dealing with Missing Data in Python
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Read the dataset 'college.csv' with na_values set to '.'
college = pd.read_csv(___, ___)
print(college.head())