Alocarea non-aleatorie a subiecților
O firmă agricolă desfășoară un experiment pentru a măsura cum influențează tipul de iarbă oferit oilor greutatea acestora. Ei au cerut ajutorul tău pentru a configura corect experimentul. Unul dintre managerii lor a sugerat că poți realiza alocarea subiecților luând primele 250 de rânduri din DataFrame și că ar trebui să fie suficient.
Sarcina ta este să îți folosești abilitățile analitice pentru a demonstra de ce aceasta ar putea fi o idee proastă. Alocă subiecții în două grupuri prin metoda non-aleatorie (primele 250 de rânduri) și observă diferențele în statisticile descriptive.
Ai primit DataFrame-ul weights, care conține o coloană cu weight (greutatea oilor) și o coloană unică de identificare id.
numpy și pandas au fost importate ca np, respectiv pd.
Acest exercițiu face parte din cursul
Design experimental în Python
Instrucțiuni pentru exercițiu
- Folosește slicing pe DataFrame pentru a pune primele 250 de rânduri din
weightsîngroup1_non_randși restul îngroup2_non_rand. - Generează statistici descriptive pentru cele două grupuri și concatenează-le într-un singur DataFrame.
- Afișează rezultatul pentru a observa diferențele.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)