데이터셋의 두 절반 비교하기
전체 데이터셋의 특성을 점검했던 것처럼, 데이터를 나눈 뒤에는 각 절반도 살펴보는 것이 중요해요. 각 데이터셋에 describe()를 사용할 수도 있지만, psych 패키지는 범주화 변수에 따라 데이터셋을 비교하는 데 도움이 되는 함수들도 제공해요.
이번 연습 문제에서는 데이터셋을 분할할 때 만든 인덱스를 사용해 범주화 변수를 만들고, 이를 gcbs 데이터셋에 추가해 보겠습니다. 범주화 변수가 준비되면, describeBy()와 statsBy()를 사용해 기본 기술통계와 집단 간 통계를 확인할 수 있어요.
주의: describeBy()의 group 인수는 벡터여야 하지만, statsBy()의 group 인수는 데이터프레임에서 범주화 변수가 들어 있는 열 이름이어야 해요. 이에 맞게 계획해 주세요!
이 연습은 강의의 일부입니다
R로 배우는 요인분석
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Use the indices from the previous exercise to create a grouping variable
group_var <- vector("numeric", nrow(gcbs))
group_var[___] <- 1
group_var[___] <- 2