始める無料で始める

読書の時間ですよ、Katniss!

そろそろ今日の作業を終える時間ですが、その前にちょっとした分析を楽しみたいと思います。今回は Hunger Games シリーズの別の書籍データセットを分析します。

整形する前に books_hunger データセットを確認したところ、少し問題があることに気づきました。DataFrame のインデックスに本のタイトルが入っているのです。このままでは整形できません。実行すると、タイトルという重要な情報を失ってしまうため、DataFrame を変換する前に変更が必要です。

books_hunger データセットは利用可能です。各書籍の title に加えて、languagepublication datepublication numberpage number に関するデータが含まれています。

この演習はコースの一部です

pandas でデータを整形する

コースを見る

演習の手順

  • books_hunger DataFrame のインデックスを、削除せずにリセットして変更してください。
  • books_hunger をワイド形式からロング形式に変換してください。ユニークなインデックスとして titlelanguage の列を使用します。publicationpage で始まる列から作られる新しい変数の名前を feature としてください。これらの列は空白で区切られ、末尾は単語で終わります。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)

# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____, 
                                       ____=____)

# Print publication_features
print(publication_features)
コードを編集して実行