始める無料で始める

標本統計と母集団の比較

この演習では、あらかじめ読み込まれている population を使います。母集団からランダムに点を抽出して sample を作成し、その標本の平均と標準偏差を計算して、標本が母集団を代表しているかを確かめます。ねらいは、標本統計量が母集団統計量と同じか、非常に近い値になるかを確認することです。

この演習はコースの一部です

Pythonで学ぶ線形モデリング入門

コースを見る

演習の手順

  • population データの平均と標準偏差を計算して表示します。
  • np.random.seed() を使って、numpy の疑似乱数サンプラーのシードを 42 に設定します。
  • np.random.choice() を使って、population から size=31(抽出する点の数)の sample を作成します。
  • sample の平均と標準偏差を計算して表示し、標本統計量と母集団統計量の表示結果を見比べて、差があるかどうかを確認します。

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Compute the population statistics
print("Population mean {:.1f}, stdev {:.2f}".format( population.____(), population.____() ))

# Set random seed for reproducibility
____.____.____(42)

# Construct a sample by randomly sampling 31 points from the population
sample = np.____.____(____, size=31)

# Compare sample statistics to the population statistics
print("    Sample mean {:.1f}, stdev {:.2f}".format( sample.____(), sample.____() ))
コードを編集して実行