Nepáhodné přiřazení subjektů
Zemědělská firma provádí experiment, který má zjistit, jak krmení ovcí různými druhy trávy ovlivňuje jejich hmotnost. Požádali tě o pomoc se správným nastavením experimentu. Jeden z jejich manažerů navrhl, že pro přiřazení subjektů stačí vzít prvních 250 řádků z DataFramu.
Tvým úkolem je pomocí analytických dovedností ukázat, proč to nemusí být dobrý nápad. Přiřaď subjekty do dvou skupin pomocí nepáhodného výběru (prvních 250 řádků) a sleduj rozdíly v popisných statistikách.
Máš k dispozici DataFrame weights, který obsahuje sloupec s hmotností ovcí weight a sloupec s jedinečným identifikátorem id.
numpy a pandas jsou importovány jako np a pd.
Toto cvičení je součástí kurzu
Experimentální design v Pythonu
Pokyny k cvičení
- Pomocí řezání DataFramu ulož prvních 250 řádků z
weightsdogroup1_non_randa zbývající řádky dogroup2_non_rand. - Vygeneruj popisné statistiky obou skupin a spoj je do jednoho DataFramu.
- Vypiš výsledek a porovnej rozdíly.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)