Zacznij terazZacznij za darmo

Pomijanie błędnych danych

W tym ćwiczeniu użyjesz parametrów read_csv() do obsługi plików zawierających błędne dane, np. rekordy z większą liczbą wartości niż kolumn. Domyślnie próba zaimportowania takich plików wywołuje konkretny błąd: pandas.errors.ParserError.

Niektóre wiersze w danych podatkowych stanu Vermont są uszkodzone. Aby wczytać poprawne wiersze, trzeba wskazać bibliotece pandas, żeby pomijała błędy. Chcemy też, żeby pandas ostrzegało nas za każdym razem, gdy pominie wiersz – dzięki temu będziemy wiedzieć, jak duży jest problem z danymi.

Biblioteka pandas została zaimportowana jako pd. Kod ćwiczenia spróbuje odczytać plik. Jeśli wystąpi błąd pandas.errors.ParserError, zostanie wykonany kod zawarty w bloku except.

To ćwiczenie jest częścią kursu

Sprawne importowanie danych z pandas

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

try:
  # Import the CSV without any keyword arguments
  data = ____
  
  # View first 5 records
  print(data.head())
  
except pd.errors.ParserError:
    print("Your data contained rows that could not be parsed.")
Edytuj i uruchom kod