Läs in en del av ett kalkylark
Kalkylark som är utformade för att läsas av människor innehåller ofta flera tabeller – ett litet företag kan till exempel ha en lagerhållningsarbetsbok med tabeller för olika produkttyper på ett och samma blad. Även tabelldata kan ha rubrikrader med metadata, som i New Developer Survey-datan här. Metadata är visserligen användbar, men vi vill inte ha den i en dataframe. Du använder nyckelordet skiprows i read_excel() för att hämta enbart datan. Du skapar också en sträng att skicka till usecols för att bara hämta kolumnerna AD och AW till och med BA, som handlar om framtida jobbmål.
pandas har importerats som pd.
Den här övningen är en del av kursen
Effektiv datainläsning med pandas
Övningsinstruktioner
- Skapa en enskild sträng,
col_string, som anger attpandasska läsa in kolumnADoch intervalletAWtill och medBA. - Läs in
fcc_survey_headers.xlsx'och angeskiprowsochusecolsså att de två första raderna med metadata hoppas över och bara kolumnerna icol_stringhämtas. - Visa de valda kolumnnamnen i den resulterande dataframen.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create string of lettered columns to load
col_string = ____
# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx",
____,
____)
# View the names of the columns selected
print(survey_responses.columns)