始める無料で始める

dplyr でのシンプルサンプリング

この章では、Spotify の楽曲データを使っていきます。データセットの各行は1曲を表し、全部で41656行あります。列には曲名、アーティスト、リリース年に加えて、曲の長さ、テンポ、ダンサビリティなどの属性が含まれます。まずは曲の長さから見ていきます。

最初のタスクでは、楽曲データセットからサンプリングし、母集団全体での計算結果とサンプルでの計算結果を比較します。

spotify_population が利用可能で、dplyr は読み込まれています。

この演習はコースの一部です

Rで学ぶサンプリング

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# View the whole population dataset
___

# Sample 1000 rows from spotify_population
spotify_sample <- ___


# See the result
spotify_sample
コードを編集して実行