dplyr でのシンプルサンプリング
この章では、Spotify の楽曲データを使っていきます。データセットの各行は1曲を表し、全部で41656行あります。列には曲名、アーティスト、リリース年に加えて、曲の長さ、テンポ、ダンサビリティなどの属性が含まれます。まずは曲の長さから見ていきます。
最初のタスクでは、楽曲データセットからサンプリングし、母集団全体での計算結果とサンプルでの計算結果を比較します。
spotify_population が利用可能で、dplyr は読み込まれています。
この演習はコースの一部です
Rで学ぶサンプリング
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# View the whole population dataset
___
# Sample 1000 rows from spotify_population
spotify_sample <- ___
# See the result
spotify_sample