Zacznij terazZacznij za darmo

Importowanie pliku we fragmentach

Podczas pracy z dużymi plikami wygodniej jest wczytywać i przetwarzać dane w częściach. Przećwiczmy ten sposób pracy na danych podatkowych z Vermont.

Pierwsze 500 wierszy zostało już wczytane jako vt_data_first500. Teraz pobierzesz kolejne 500 wierszy. W tym celu skorzystasz z kilku argumentów kluczowych: nrows i skiprows, aby wybrać odpowiednie rekordy, header, aby poinformować pandas, że dane nie mają nazw kolumn, oraz names, aby uzupełnić brakujące nazwy kolumn. Przyda ci się też funkcja list(), która pozwoli pobrać nazwy kolumn z vt_data_first500 do ponownego użycia.

Biblioteka pandas została zaimportowana jako pd.

To ćwiczenie jest częścią kursu

Sprawne importowanie danych z pandas

Zobacz kurs

Instrukcje do ćwiczenia

  • Użyj argumentów nrows i skiprows, aby utworzyć ramkę danych vt_data_next500 zawierającą kolejne 500 wierszy.
  • Ustaw argument header tak, aby pandas wiedział, że dane nie zawierają wiersza nagłówka.
  • Nadaj kolumnom w vt_data_next500 nazwy, przekazując listę kolumn z vt_data_first500 do argumentu names.

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Create dataframe of next 500 rows with labeled columns
vt_data_next500 = pd.read_csv("vt_tax_data_2016.csv", 
                       		  ____,
                       		  ____,
                       		  ____,
                       		  ____)

# View the Vermont dataframes to confirm they're different
print(vt_data_first500.head())
print(vt_data_next500.head())
Edytuj i uruchom kod