Élémentaire, mon cher Watson!
C'est vendredi et vous êtes sur le point de terminer votre projet de livre. Pour votre dernière tâche, vous allez analyser des données sur les livres d'Arthur Conan Doyle.
Vous constatez que votre jeu de données, books_sh, a besoin d'être reformaté. Vous remarquez qu'il y a des colonnes qui peuvent être regroupées à l'aide d'un préfixe. Vous identifiez les colonnes à utiliser comme identifiants uniques. Cependant, certaines de ces colonnes contiennent des chaînes de caractères. Elles doivent être traitées avant d'appliquer une transformation de format large vers long. Vous décidez de scinder certaines chaînes pour rendre le DataFrame plus propre.
Le jeu de données books_sh est à votre disposition. Il contient le title et des données sur la version, le number_pages et le number_ratings de chaque livre.
Cette activité fait partie du cours
Remanier des données avec pandas
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Split main_title by a colon and assign it to two columns named title and subtitle
books_sh[['title', 'subtitle']] = ____[____].____.____(____, ____=____)
# Print books_sh
print(books_sh)