被験体の非ランダムな割り当て
ある農業企業が、羊に異なる種類の草を与えると体重にどのような影響があるかを測る実験を行っています。実験の正しいセットアップについて、あなたに協力を依頼しました。担当マネージャーの一人は、被験体の割り当ては DataFrame の先頭250行を取れば十分だと言っています。
あなたのタスクは、分析スキルを使って、これが良くない考えかもしれない理由を示すことです。被験体を非ランダム(先頭250行)に2つのグループへ割り当て、記述統計量の違いを観察してください。
あなたは DataFrame weights を受け取っており、羊のweight列と一意のid列が含まれています。
numpy と pandas はそれぞれ np と pd としてインポート済みです。
この演習はコースの一部です
Pythonで学ぶ実験計画法
演習の手順
- DataFrame のスライスを使って、
weightsの先頭250行をgroup1_non_randに、残りをgroup2_non_randに入れてください。 - 2つのグループの記述統計量を生成し、1つの DataFrame に連結してください。
- 差異を観察できるように出力してください。
実践的なインタラクティブ演習
このサンプルコードを完成させて、この演習に挑戦してみましょう。
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)