ケーススタディ・チャレンジ - パート3
脳震盪などのけがは、個々の選手に紐づきます。ケーススタディ・チャレンジの第3回(最終回)では、各プレーに参加した選手を表すデータを追加します。プレーヤーデータには、一部のプレーで該当選手が欠けている場合があります。また、プレーヤーデータはより長い期間を対象としており、他のプレーのデータも含まれている可能性があります。
players.csv には選手データが含まれています。パート2で作成したデータフレーム games_plays はすでに読み込まれています。
この演習はコースの一部です
スプレッドシート利用者のためのPandas結合
演習の手順
- 選手データを読み込み、データフレームの列名を一覧表示します。
- 試合とプレーのデータフレームに、選手データを結合します。各データフレームのすべての行を含め、どのフレームに行が含まれていたかを示す情報も保持します。
- 結果のデータフレームについて情報を取得します。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Load player data and list columns
players = ____('players.csv')
print(____.columns)
# Merge data
train_df = ____.merge(players, how=____, on=[____, ____], ____=True)
# View data frame information
____.info()