始める無料で始める

3種類のサンプリング

単純、層化、クラスタサンプリングを使って、ポイント推定の性能を比較します。その前に、まずサンプルを作成しましょう。

attrition_pop データセットの RelationshipSatisfaction 列を使います。これは従業員の会社に対する満足度をカテゴリ化したもので、LowMediumHighVery_High の4段階があります。pandas は一般的なエイリアスで読み込まれており、random パッケージも読み込まれています。

この演習はコースの一部です

Pythonで学ぶサンプリング

コースを見る

実践的なインタラクティブ演習

このサンプルコードを完成させて、この演習に挑戦してみましょう。

# Perform simple random sampling to get 0.25 of the population
attrition_srs = ____
コードを編集して実行