Încarcă o parte dintr-o foaie de calcul
Foile de calcul concepute pentru a fi citite de oameni conțin adesea mai multe tabele – de exemplu, o mică afacere ar putea ține un registru de inventar cu tabele pentru diferite tipuri de produse pe o singură foaie. Chiar și datele tabulare pot avea rânduri de antet cu metadate, cum este cazul datelor din New Developer Survey de aici. Deși metadatele sunt utile, nu ne dorim să le includem într-un dataframe. Vei folosi cuvântul cheie skiprows al funcției read_excel() pentru a obține doar datele propriu-zise. De asemenea, vei crea un șir de caractere pe care să îl transmiți la usecols, pentru a selecta doar coloanele AD și AW până la BA, referitoare la obiectivele de carieră viitoare.
pandas a fost importat ca pd.
Acest exercițiu face parte din cursul
Ingestie eficientă a datelor cu pandas
Instrucțiuni pentru exercițiu
- Creează un șir de caractere unic,
col_string, care să specifice căpandastrebuie să încarce coloanaADși intervalul de laAWpână laBA. - Încarcă fișierul
fcc_survey_headers.xlsx, setândskiprowsșiusecolspentru a sări primele două rânduri de metadate și a obține doar coloanele dincol_string. - Vizualizează numele coloanelor selectate din dataframe-ul rezultat.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create string of lettered columns to load
col_string = ____
# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx",
____,
____)
# View the names of the columns selected
print(survey_responses.columns)