読書の時間ですよ、Katniss!
そろそろ今日の作業を終える時間ですが、その前にちょっとした分析を楽しみたいと思います。今回は Hunger Games シリーズの別の書籍データセットを分析します。
整形する前に books_hunger データセットを確認したところ、少し問題があることに気づきました。DataFrame のインデックスに本のタイトルが入っているのです。このままでは整形できません。実行すると、タイトルという重要な情報を失ってしまうため、DataFrame を変換する前に変更が必要です。
books_hunger データセットは利用可能です。各書籍の title に加えて、language、publication date、publication number、page number に関するデータが含まれています。
この演習はコースの一部です
pandas でデータを整形する
演習の手順
books_hungerDataFrame のインデックスを、削除せずにリセットして変更してください。books_hungerをワイド形式からロング形式に変換してください。ユニークなインデックスとしてtitleとlanguageの列を使用します。publicationとpageで始まる列から作られる新しい変数の名前をfeatureとしてください。これらの列は空白で区切られ、末尾は単語で終わります。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Modify books_hunger by resetting the index without dropping it
books_hunger.____(____=____, inplace=____)
# Reshape using title and language as index, feature as new name, publication and page as prefix separated by space and ending in a word
publication_features = pd.wide_to_long(____,
____=____,
____=____,
____=____,
____=____,
____=____)
# Print publication_features
print(publication_features)