そして監督賞は…… <NA> に?
director_df として事前に読み込まれている Netflix データセットのサンプルを扱います。今回は、データフレームには監督名と映画タイトルのみが入っています。目標は、最も多くの映画を手がけた監督を特定することです。director 列には複数の名前が入っているので、まずは値を複数行に分割し、その後で監督ごとに数えます。
監督が不明の映画で集計が汚れないように、drop_na() 関数を使います。
dplyr パッケージはすでに読み込まれています。
この演習はコースの一部です
tidyrでデータを整形する
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
director_df %>%
# Spread the director column over separate rows
___