平均の平均
1件あたりのユーザー数(num_users)の平均を知りたいとします。ただし、Amir の案件が会社全体の平均と比べて多いのか少ないのかを確認したいので、会社全体での平均を知る必要があります。問題は、過去1年間で会社は1万件以上の案件に取り組んでおり、すべてのデータを集計するのは現実的ではないことです。そこで、会社全体からデータを集める代わりに、いくつかの案件を無作為抽出して標本平均を計算し、母平均を推定します。
会社の全案件に関するユーザーデータは all_deals にあります。
この演習はコースの一部です
Rで学ぶ統計入門
演習の手順
- 乱数シードを
321に設定します。 all_deals$num_usersからサイズ20のサンプルを30回取り、各サンプルの平均を計算します。標本平均はsample_meansに保存します。sample_meansの平均を求めます。amir_dealsのnum_users列の平均を求めます。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Set seed to 321
___
# Take 30 samples of 20 values of num_users, take mean of each sample
sample_means <- ___(___, ___(___, ___) %>% mean())
# Calculate mean of sample_means
___
# Calculate mean of num_users in amir_deals
___