Kom igångKom igång gratis

Läs in en del av ett kalkylark

Kalkylark som är utformade för att läsas av människor innehåller ofta flera tabeller – ett litet företag kan till exempel ha en lagerhållningsarbetsbok med tabeller för olika produkttyper på ett och samma blad. Även tabelldata kan ha rubrikrader med metadata, som i New Developer Survey-datan här. Metadata är visserligen användbar, men vi vill inte ha den i en dataframe. Du använder nyckelordet skiprows i read_excel() för att hämta enbart datan. Du skapar också en sträng att skicka till usecols för att bara hämta kolumnerna AD och AW till och med BA, som handlar om framtida jobbmål.

pandas har importerats som pd.

Den här övningen är en del av kursen

Effektiv datainläsning med pandas

Visa kurs

Övningsinstruktioner

  • Skapa en enskild sträng, col_string, som anger att pandas ska läsa in kolumn AD och intervallet AW till och med BA.
  • Läs in fcc_survey_headers.xlsx' och ange skiprows och usecols så att de två första raderna med metadata hoppas över och bara kolumnerna i col_string hämtas.
  • Visa de valda kolumnnamnen i den resulterande dataframen.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Create string of lettered columns to load
col_string = ____

# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx", 
                        ____, 
                        ____)

# View the names of the columns selected
print(survey_responses.columns)
Redigera och kör kod