Personalizarea importului unui fișier spreadsheet
În acest exercițiu, vei analiza fișierele spreadsheet folosind argumente suplimentare pentru a sări peste rânduri, a redenumi coloane și a selecta doar anumite coloane.
Fișierul spreadsheet 'battledeath.xlsx' este deja încărcat ca
xls.
Ca și până acum, vei folosi metoda parse(). De data aceasta, însă,
vei adăuga argumentele suplimentare skiprows, names și
usecols. Acestea permit, respectiv, să sari peste rânduri, să denumești coloanele și să specifici
care coloane să fie analizate. Toate aceste argumente pot
fi atribuite unor liste care conțin numerele de rând, șirurile de caractere
sau numerele de coloană corespunzătoare.
Acest exercițiu face parte din cursul
Introducere în importul datelor în Python
Instrucțiuni pentru exercițiu
- Analizează primul sheet după index. În acest proces, sari peste primul rând de date și denumește coloanele
'Country'și'AAM due to War (2002)'folosind argumentulnames. Valorile transmise laskiprowsșinamestrebuie să fie de tiplist. - Analizează al doilea sheet după index. În acest proces, folosește parametrul
usecolspentru a analiza doar prima coloană, sari peste primul rând și redenumește coloana'Country'. Argumentul transmis lausecolstrebuie să fie, de asemenea, de tiplist.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Parse the first sheet and rename the columns: df1
df1 = xls.parse(____, skiprows=____, names=____)
# Print the head of the DataFrame df1
print(df1.head())
# Parse the first column of the second sheet and rename the column: df2
df2 = xls.parse(____, usecols=____, skiprows=____, names=____)
# Print the head of the DataFrame df2
print(df2.head())