시작하기무료로 시작하기

그룹 비교하기

이 연습 문제에서는 그룹별로 데이터를 비교하여 분포를 살펴보겠습니다.

datasets 패키지의 PlantGrowth 데이터셋은 수확량에 대한 실험 결과를 담고 있습니다. 데이터셋에는 두 개의 변수가 있습니다:

  • group - 해당 결과가 대조군인지, 두 개의 처리군 중 하나인지 나타냅니다.
  • weight - 수확량을 측정하기 위해 사용한 식물의 건조 무게입니다.

tapply()를 사용하면 그룹별로 통계를 계산할 수 있다는 점을 기억하세요.

예를 들어,

tapply(df$x, df$grp, FUN = median)

은 데이터 프레임 df에서 grpx의 중앙값을 반환합니다.

여러분의 과제는 수확량 무게의 평균을 계산하고, 다섯 가지 대표 통계(최솟값, 1사분위수, 중앙값, 3사분위수, 최댓값)를 시각화하는 것입니다. 그래프를 통해 그룹 간 반응 변수의 차이를 비교할 수 있습니다.

이 연습은 강의의 일부입니다

R로 연습하는 통계 면접 질문

강의 보기

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Calculate means across groups
tapply(___, PlantGrowth$group, FUN = ___)

# Graphically compare statistics across groups
___(___ ~ group, data = ___)
코드 편집 및 실행