3種類のサンプリング
単純、層化、クラスタサンプリングを使って、ポイント推定の性能を比較します。その前に、まずサンプルを作成しましょう。
attrition_pop データセットの RelationshipSatisfaction 列を使います。これは従業員の会社に対する満足度をカテゴリ化したもので、Low、Medium、High、Very_High の4段階があります。pandas は一般的なエイリアスで読み込まれており、random パッケージも読み込まれています。
この演習はコースの一部です
Pythonで学ぶサンプリング
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Perform simple random sampling to get 0.25 of the population
attrition_srs = ____