Niet-willekeurige toewijzing van proefpersonen
Een agrarisch bedrijf voert een experiment uit om te meten hoe het voeren van verschillende grassoorten aan schapen hun gewicht beïnvloedt. Ze hebben je gevraagd om te helpen het experiment goed op te zetten. Een van hun managers zei dat je de toewijzing van proefpersonen kunt uitvoeren door de bovenste 250 rijen uit de DataFrame te nemen en dat dat prima zou zijn.
Jouw taak is om met je analytische vaardigheden te laten zien waarom dit misschien geen goed idee is. Wijs de proefpersonen toe aan twee groepen met een niet-willekeurige toewijzing (de eerste 250 rijen) en bekijk de verschillen in beschrijvende statistieken.
Je hebt de DataFrame weights ontvangen, met een kolom met het weight van de schapen en een unieke id-kolom.
numpy en pandas zijn respectievelijk geïmporteerd als np en pd.
Deze oefening maakt deel uit van de cursus
Experimenteel ontwerpen in Python
Oefeninstructies
- Gebruik DataFrame-slicing om de eerste 250 rijen van
weightsingroup1_non_randte plaatsen en de rest ingroup2_non_rand. - Genereer beschrijvende statistieken van de twee groepen en voeg ze samen tot één DataFrame.
- Print het resultaat om de verschillen te bekijken.
Interactieve oefening met praktijkervaring
Probeer deze oefening door deze voorbeeldcode aan te vullen.
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)