Pomijanie błędnych danych
W tym ćwiczeniu użyjesz parametrów read_csv() do obsługi plików zawierających błędne dane, np. rekordy z większą liczbą wartości niż kolumn. Domyślnie próba zaimportowania takich plików wywołuje konkretny błąd: pandas.errors.ParserError.
Niektóre wiersze w danych podatkowych stanu Vermont są uszkodzone. Aby wczytać poprawne wiersze, trzeba wskazać bibliotece pandas, żeby pomijała błędy. Chcemy też, żeby pandas ostrzegało nas za każdym razem, gdy pominie wiersz – dzięki temu będziemy wiedzieć, jak duży jest problem z danymi.
Biblioteka pandas została zaimportowana jako pd. Kod ćwiczenia spróbuje odczytać plik. Jeśli wystąpi błąd pandas.errors.ParserError, zostanie wykonany kod zawarty w bloku except.
To ćwiczenie jest częścią kursu
Sprawne importowanie danych z pandas
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
try:
# Import the CSV without any keyword arguments
data = ____
# View first 5 records
print(data.head())
except pd.errors.ParserError:
print("Your data contained rows that could not be parsed.")