ÎncepețiÎncepe gratuit

Încarcă o parte dintr-o foaie de calcul

Foile de calcul concepute pentru a fi citite de oameni conțin adesea mai multe tabele – de exemplu, o mică afacere ar putea ține un registru de inventar cu tabele pentru diferite tipuri de produse pe o singură foaie. Chiar și datele tabulare pot avea rânduri de antet cu metadate, cum este cazul datelor din New Developer Survey de aici. Deși metadatele sunt utile, nu ne dorim să le includem într-un dataframe. Vei folosi cuvântul cheie skiprows al funcției read_excel() pentru a obține doar datele propriu-zise. De asemenea, vei crea un șir de caractere pe care să îl transmiți la usecols, pentru a selecta doar coloanele AD și AW până la BA, referitoare la obiectivele de carieră viitoare.

pandas a fost importat ca pd.

Acest exercițiu face parte din cursul

Ingestie eficientă a datelor cu pandas

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează un șir de caractere unic, col_string, care să specifice că pandas trebuie să încarce coloana AD și intervalul de la AW până la BA.
  • Încarcă fișierul fcc_survey_headers.xlsx, setând skiprows și usecols pentru a sări primele două rânduri de metadate și a obține doar coloanele din col_string.
  • Vizualizează numele coloanelor selectate din dataframe-ul rezultat.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Create string of lettered columns to load
col_string = ____

# Load data with skiprows and usecols set
survey_responses = ____("fcc_survey_headers.xlsx", 
                        ____, 
                        ____)

# View the names of the columns selected
print(survey_responses.columns)
Editează și rulează codul