시작하기무료로 시작하기

하나 이상의 변수에 대한 특정 통계

앞서 보셨듯이, 데이터셋의 하나 이상의 변수에 대해 summary(), psych::describe(), Hmisc::describe() 같은 함수를 사용하면 여러 기술 통계를 한 번에 확인할 수 있어요. 또한 이전 연습에서는 mean(), median(), sd() 등의 함수를 사용해 개별 통계를 계산했죠.

하지만 dplyr 패키지에서는 summarise() 함수만으로도, 또는 across(everything(), list()) 구문을 더해 여러 관심 통계를 한 번에 사용자 지정해 하나 이상의 변수에 대해 계산할 수 있습니다.

abaloneKeep 데이터셋과 dplyr 패키지는 이미 로드되어 있어요.

이 연습은 강의의 일부입니다

SAS 사용자를 위한 R

강의 보기

연습 안내

  • abaloneKeep 데이터셋에서 shucked weight와 whole weight에 대한 요약 통계를 summary()로 구하세요.
  • dplyr 패키지의 summarise() 함수를 사용해 length의 평균과 표준편차를 구하세요. 출력 통계의 이름은 각각 평균과 표준편차에 대해 mean_length, sd_length로 지정하세요.
  • dplyr 패키지의 summarise(across(everything(), list())) 구문을 사용해 height와 diameter의 평균과 표준편차를 구하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Run summary() for shuckedWeight and wholeWeight
abaloneKeep %>%
  select(___, ___) %>%
  ___

# Get mean and sd for length
abaloneKeep %>%
  ___(___ = mean(___),
      ___ = sd(___))

# Get mean and sd for height and diameter
abaloneKeep %>%
  ___ %>%
  summarise(across(everything(),list(___ = ~ mean(.x),
                                     ___ = ~ sd(.x))))
코드 편집 및 실행