Personnaliser l'importation de votre feuille de calcul
Ici, vous allez analyser vos feuilles de calcul et utiliser des paramètres supplémentaires pour ignorer des lignes, renommer des colonnes et sélectionner seulement certaines colonnes.
La feuille de calcul 'battledeath.xlsx' est déjà chargée sous
xls.
Comme précédemment, vous utiliserez la méthode parse(). Cette fois, toutefois,
vous ajouterez les paramètres supplémentaires skiprows, names et
usecols. Ceux-ci servent respectivement à ignorer des lignes, nommer les colonnes et indiquer
quelles colonnes analyser. Tous ces paramètres peuvent
recevoir des listes contenant, selon le cas, les numéros de lignes, les chaînes de caractères
et les numéros de colonnes appropriés.
Cette activité fait partie du cours
Introduction à l'importation de données en Python
Instructions de l’exercice
- Analysez la première feuille par index. Ce faisant, ignorez la première ligne de données et nommez les colonnes
'Country'et'AAM due to War (2002)'à l'aide du paramètrenames. Les valeurs passées àskiprowsetnamesdoivent toutes être de typelist. - Analysez la deuxième feuille par index. Ce faisant, analysez uniquement la première colonne avec le paramètre
usecols, ignorez la première ligne et renommez la colonne'Country'. L'argument transmis àusecolsdoit également être de typelist.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Parse the first sheet and rename the columns: df1
df1 = xls.parse(____, skiprows=____, names=____)
# Print the head of the DataFrame df1
print(df1.head())
# Parse the first column of the second sheet and rename the column: df2
df2 = xls.parse(____, usecols=____, skiprows=____, names=____)
# Print the head of the DataFrame df2
print(df2.head())