CommencezCommencez gratuitement

Affectation non aléatoire des sujets

Une entreprise agricole mène une expérience pour mesurer comment différents types d'herbe donnés aux moutons influent sur leur poids. Elle a demandé votre aide pour bien structurer l'expérience. Un de leurs gestionnaires a proposé d'affecter les sujets en prenant les 250 premières lignes du DataFrame, estimant que cela devrait suffire.

Votre tâche consiste à montrer, à l'aide d'analyses, pourquoi ce n'est peut-être pas une bonne idée. Affectez les sujets à deux groupes de façon non aléatoire (les 250 premières lignes) et observez les différences dans les statistiques descriptives.

Vous avez reçu le DataFrame weights, qui contient une colonne weight pour le poids des moutons et une colonne id unique.

numpy et pandas ont été importés sous les alias np et pd.

Cette activité fait partie du cours

Conception d'expériences en Python

Voir le cours

Instructions de l’exercice

  • Utilisez le découpage d'un DataFrame pour placer les 250 premières lignes de weights dans group1_non_rand et le reste dans group2_non_rand.
  • Générez les statistiques descriptives des deux groupes et concaténez-les dans un seul DataFrame.
  • Affichez le résultat pour observer les différences.

Exercice interactif pratique

Essayez cet exercice en complétant ce code d’exemple.

# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____

# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']

# Print to assess
print(____)
Modifier et exécuter le code