대상 비무작위 배정
한 농업 회사가 서로 다른 종류의 풀을 양에게 먹였을 때 체중에 어떤 영향이 있는지 측정하는 실험을 진행하고 있어요. 올바르게 실험을 설정할 수 있도록 여러분의 도움이 필요해요. 한 관리자는 DataFrame에서 위에서부터 250개 행을 가져와 대상 배정을 하면 충분하다고 말했어요.
여러분의 과제는 왜 이것이 좋은 생각이 아닐 수 있는지 분석을 통해 보여주는 거예요. 비무작위 배정(처음 250개 행)을 사용해 대상을 두 그룹으로 나누고, 기술 통계의 차이를 관찰하세요.
여러분은 양의 weight가 들어 있는 열과 고유한 id 열을 가진 DataFrame weights를 받았어요.
numpy와 pandas는 각각 np와 pd로 임포트되어 있어요.
이 연습은 강의의 일부입니다
Python으로 배우는 실험 설계
연습 안내
- DataFrame 슬라이싱을 사용해
weights의 처음 250개 행을group1_non_rand에, 나머지를group2_non_rand에 저장하세요. - 두 그룹의 기술 통계를 생성하고 하나의 DataFrame으로 연결(concatenate)하세요.
- 출력하여 차이를 관찰하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Non-random assignment
group1_non_rand = ____
group2_non_rand = ____
# Compare descriptive statistics of groups
compare_df_non_rand = ____([group1_non_rand['weight'].____, group2_non_rand['weight'].____], axis=1)
compare_df_non_rand.columns = ['group1', 'group2']
# Print to assess
print(____)