Doplňování chybějících hodnot pomocí pandas
Při budování datových pipeline se nevyhnutelně setkáš s chybějícími daty. V některých případech tato záznamy z datasetu odstraníš, jindy ale budeš muset chybějící hodnoty doplnit. V tomto cvičení si procvičíš, jak k tomu využít pandas.
Data ze souboru "testing_scores.json" jsou načtena do DataFrame a uložena v proměnné raw_testing_scores. Knihovna pandas je dostupná pod aliasem pd.
Toto cvičení je součástí kurzu
ETL a ELT v Pythonu
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Print the head of the `raw_testing_scores` DataFrame
print(raw_testing_scores.____)