Affectation non aléatoire des sujets
Une entreprise agricole mène une expérience pour mesurer comment différents types d'herbe donnés aux moutons influent sur leur poids. Elle a demandé votre aide pour bien structurer l'expérience. Un de leurs gestionnaires a proposé d'affecter les sujets en prenant les 250 premières lignes du DataFrame, estimant que cela devrait suffire.
Votre tâche consiste à montrer, à l'aide d'analyses, pourquoi ce n'est peut-être pas une bonne idée. Affectez les sujets à deux groupes de façon non aléatoire (les 250 premières lignes) et observez les différences dans les statistiques descriptives.
Vous avez reçu le DataFrame weights, qui contient une colonne weight pour le poids des moutons et une colonne id unique.
numpy et pandas ont été importés sous les alias np et pd.
Cette activité fait partie du cours
Conception d'expériences en Python
Instructions de l’exercice
- Utilisez le découpage d'un DataFrame pour placer les 250 premières lignes de
weightsdansgroup1_non_randet le reste dansgroup2_non_rand. - Générez les statistiques descriptives des deux groupes et concaténez-les dans un seul DataFrame.
- Affichez le résultat pour observer les différences.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)