하나 이상의 변수에 대한 특정 통계
앞서 보셨듯이, 데이터셋의 하나 이상의 변수에 대해 summary(), psych::describe(), Hmisc::describe() 같은 함수를 사용하면 여러 기술 통계를 한 번에 확인할 수 있어요. 또한 이전 연습에서는 mean(), median(), sd() 등의 함수를 사용해 개별 통계를 계산했죠.
하지만 dplyr 패키지에서는 summarise() 함수만으로도, 또는 across(everything(), list()) 구문을 더해 여러 관심 통계를 한 번에 사용자 지정해 하나 이상의 변수에 대해 계산할 수 있습니다.
abaloneKeep 데이터셋과 dplyr 패키지는 이미 로드되어 있어요.
이 연습은 강의의 일부입니다
SAS 사용자를 위한 R
연습 안내
abaloneKeep데이터셋에서 shucked weight와 whole weight에 대한 요약 통계를summary()로 구하세요.dplyr패키지의summarise()함수를 사용해 length의 평균과 표준편차를 구하세요. 출력 통계의 이름은 각각 평균과 표준편차에 대해mean_length,sd_length로 지정하세요.dplyr패키지의summarise(across(everything(), list()))구문을 사용해 height와 diameter의 평균과 표준편차를 구하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Run summary() for shuckedWeight and wholeWeight
abaloneKeep %>%
select(___, ___) %>%
___
# Get mean and sd for length
abaloneKeep %>%
___(___ = mean(___),
___ = sd(___))
# Get mean and sd for height and diameter
abaloneKeep %>%
___ %>%
summarise(across(everything(),list(___ = ~ mean(.x),
___ = ~ sd(.x))))