L'argument skip
Un autre argument très utile lorsque vous lisez des fichiers Excel moins bien structurés est skip. Avec skip, vous pouvez indiquer à R d'ignorer un certain nombre de lignes dans les feuilles Excel dont vous voulez extraire des données. Voyez cet exemple :
read_excel("data.xlsx", skip = 15)
Dans ce cas, les 15 premières lignes de la première feuille de "data.xlsx" sont ignorées.
Si la première ligne de cette feuille contenait les noms de colonnes, cette information sera aussi ignorée par readxl. Assurez-vous donc de définir col_names à FALSE ou de préciser les noms de colonnes manuellement dans ce cas !
Le fichier urbanpop.xlsx (view) est disponible dans votre répertoire; il contient des noms de colonnes dans les premières lignes.
Cette activité fait partie du cours
Introduction à l'importation de données dans R
Instructions de l’exercice
- Importez la deuxième feuille de
"urbanpop.xlsx", mais ignorez les 21 premières lignes. Assurez-vous de définircol_names = FALSE. Stockez le tableau de données résultant dans une variableurbanpop_sel. - Sélectionnez la première observation de
urbanpop_selet affichez-la.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Import the second sheet of urbanpop.xlsx, skipping the first 21 rows: urbanpop_sel
urbanpop_sel <- read_excel("urbanpop.xlsx", sheet = ___, col_names =___, skip = ___)
# Print out the first observation from urbanpop_sel
___