Wczytaj fragment arkusza kalkulacyjnego
Arkusze kalkulacyjne tworzone z myślą o ludziach często zawierają wiele tabel – na przykład mała firma może prowadzić skoroszyt magazynowy z tabelami dla różnych typów produktów na jednym arkuszu. Dane tabelaryczne mogą też mieć wiersze nagłówkowe z metadanymi, tak jak w przypadku danych z ankiety New Developer Survey. Metadane bywają przydatne, ale nie chcemy ich w ramce danych. Użyj argumentu skiprows funkcji read_excel(), aby wczytać tylko właściwe dane. Stworzysz też łańcuch znaków przekazywany do usecols, aby pobrać wyłącznie kolumny AD oraz AW–BA, dotyczące przyszłych celów zawodowych.
pandas zostało zaimportowane jako pd.
To ćwiczenie jest częścią kursu
Sprawne importowanie danych z pandas
Instrukcje do ćwiczenia
- Utwórz pojedynczy łańcuch znaków
col_string, który wskazuje bibliotecepandas, że ma wczytać kolumnęADoraz zakres odAWdoBA. - Wczytaj plik
fcc_survey_headers.xlsx, ustawiającskiprowsiusecolstak, aby pominąć pierwsze dwa wiersze metadanych i pobrać tylko kolumny określone wcol_string. - Wyświetl nazwy wybranych kolumn w uzyskanej ramce danych.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create string of lettered columns to load
col_string = ____
# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx",
____,
____)
# View the names of the columns selected
print(survey_responses.columns)