관심 통계량 계산하기
NHANES 데이터셋을 사용하여 성별과 주택 소유 간의 관계를 살펴보겠습니다. 데이터셋에 대한 더 자세한 정보는 여기에서 확인할 수 있어요: NHANES.
영상에서 보셨듯이, 모집단에 존재할 수 있는 관계를 제거하기 위해 관측값을 섞어(셔플)서 자연스러운 변동성을 모형화할 수 있습니다. 다만 데이터를 치환(permutation)하기 전에, 먼저 원래 관측된 통계량을 계산해야 해요. 이 연습에서는 남성과 여성의 주택 소유 비율 차이를 계산하겠습니다.
기억해 두세요:
%in%은 왼쪽 값이 오른쪽에 나열되어 있으면 해당 위치에TRUE를 반환하는 논리 벡터를 돌려줍니다.- 논리 벡터의 평균은 해당 벡터가
TRUE인 경우의 비율입니다.
fruits <- c("apple", "banana", "cherry")
fruits %in% c("banana", "cherry")
mean(fruits %in% c("banana", "cherry"))
이 연습은 강의의 일부입니다
R에서의 추론 기초
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
homes <- NHANES %>%
# Select Gender and HomeOwn
___(___, ___) %>%
# Filter for HomeOwn equal to "Own" or "Rent"
___(___ %in% c("___", "___"))