始める無料で始める

ケーススタディ・チャレンジ - パート3

脳震盪などのけがは、個々の選手に紐づきます。ケーススタディ・チャレンジの第3回(最終回)では、各プレーに参加した選手を表すデータを追加します。プレーヤーデータには、一部のプレーで該当選手が欠けている場合があります。また、プレーヤーデータはより長い期間を対象としており、他のプレーのデータも含まれている可能性があります。

players.csv には選手データが含まれています。パート2で作成したデータフレーム games_plays はすでに読み込まれています。

この演習はコースの一部です

スプレッドシート利用者のためのPandas結合

コースを見る

演習の手順

  • 選手データを読み込み、データフレームの列名を一覧表示します。
  • 試合とプレーのデータフレームに、選手データを結合します。各データフレームのすべての行を含め、どのフレームに行が含まれていたかを示す情報も保持します。
  • 結果のデータフレームについて情報を取得します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Load player data and list columns
players = ____('players.csv')
print(____.columns)

# Merge data
train_df = ____.merge(players, how=____, on=[____, ____], ____=True)

# View data frame information
____.info()
コードを編集して実行