始める無料で始める

平均の平均

1件あたりのユーザー数(num_users)の平均を知りたいとします。ただし、Amir の案件が会社全体の平均と比べて多いのか少ないのかを確認したいので、会社全体での平均を知る必要があります。問題は、過去1年間で会社は1万件以上の案件に取り組んでおり、すべてのデータを集計するのは現実的ではないことです。そこで、会社全体からデータを集める代わりに、いくつかの案件を無作為抽出して標本平均を計算し、母平均を推定します。

会社の全案件に関するユーザーデータは all_deals にあります。

この演習はコースの一部です

Rで学ぶ統計入門

コースを見る

演習の手順

  • 乱数シードを 321 に設定します。
  • all_deals$num_users からサイズ20のサンプルを30回取り、各サンプルの平均を計算します。標本平均は sample_means に保存します。
  • sample_means の平均を求めます。
  • amir_dealsnum_users 列の平均を求めます。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Set seed to 321
___

# Take 30 samples of 20 values of num_users, take mean of each sample
sample_means <- ___(___, ___(___, ___) %>% mean())

# Calculate mean of sample_means
___

# Calculate mean of num_users in amir_deals
___
コードを編集して実行