CommencezCommencez gratuitement

C'est l'heure de lire, Katniss!

La journée de travail achève. Mais avant de partir, vous voulez faire une petite analyse pour le plaisir. Vous allez analyser un autre jeu de données de livres, cette fois sur la série Hunger Games.

Vous avez exploré le jeu de données books_hunger avant de le remodeler, mais quelque chose clochait. L'index du DataFrame contient le titre des livres. Vous savez qu'on ne peut pas le remodeler dans cet état. Sinon, vous perdrez une donnée précieuse, le titre; vous devez donc faire quelques ajustements avant de transformer le DataFrame.

Le jeu de données books_hunger est à votre disposition. Il contient le title, ainsi que des données sur la language, la publication date, le publication number et le page number de chaque livre.

Cette activité fait partie du cours

Remanier des données avec pandas

Voir le cours

Instructions de l’exercice

  • Modifiez le DataFrame books_hunger en réinitialisant l'index sans le supprimer.
  • Transformez books_hunger du format large au format long. Utilisez les colonnes title et language comme index uniques. Nommez feature la nouvelle variable créée à partir des colonnes qui commencent par publication et page. Ces colonnes sont séparées par un espace blanc et se terminent par un mot.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)

# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____)

# Print publication_features
print(publication_features)
Modifier et exécuter le code