평균, 편차, 표준편차
평균은 데이터의 중심을, 표준편차는 데이터의 흩어짐(분산 정도)을 설명해요. 하지만 두 변수를 비교하려면 둘 다 표준화해 두는 것이 편리합니다. 이 연습 문제에서는 상관이 매우 높은 두 개의 데이터 배열이 주어지며, 각 배열의 표준화된 편차를 계산하고 시각화해 볼 거예요.

이 연습은 강의의 일부입니다
Python으로 배우는 선형 모델 입문
연습 안내
- 편차
dx와dy를 계산하세요. - 표준화된 편차
zx와zy를 계산하세요. plot_cdfs()를 호출하여 원자료와 표준화된 데이터가 어떻게 비교되는지 확인하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Compute the deviations by subtracting the mean offset
dx = x - np.____(x)
dy = y - np.____(y)
# Normalize the data by dividing the deviations by the standard deviation
zx = dx / np.____(x)
zy = dy / np.____(y)
# Plot comparisons of the raw data and the normalized data
fig = plot_cdfs(dx, dy, zx, zy)