시작하기무료로 시작하기

가설 검정: 지진 발생 빈도가 변했을까요?

폐수 주입이 시작된 이후 지진 발생 빈도가 급격히 증가한 것은 분명합니다. 그럼에도 불구하고, 연습 삼아 가설 검정을 수행해 보겠습니다. 폐수 주입이 분포 자체에 영향을 미칠 수 있으므로, 2010년 이전과 이후의 지진 간격 시간이 동일한 분포를 따른다는 가설은 검정하지 않습니다. 대신, 두 기간의 평균이 같다고 가정합니다. 2010년 이전 지진 간격 시간의 평균에서 2010년 이후 평균을 뺀 값을 검정 통계량으로 사용하여, 두 기간의 지진 간격 시간 평균이 동일하다는 가설에 대한 p-값을 계산하세요.

이 연습은 강의의 일부입니다

통계적 사고 사례 연구

강의 보기

연습 안내

  • 관측 검정 통계량을 계산하세요. 이전 연습 문제에서 사용한 변수 mean_dt_premean_dt_post는 네임스페이스에 이미 저장되어 있습니다.
  • 2010년 이후 데이터를 2010년 이전 데이터와 평균이 같도록 이동시키세요. 결과를 dt_post_shift에 저장하세요.
  • dt_predt_post_shift 각각의 평균에 대해 부트스트랩 복제값을 10,000개씩 추출하세요. 결과를 각각 bs_reps_prebs_reps_post에 저장하세요.
  • bs_reps_pre에서 bs_reps_post를 빼서 평균 차이의 복제값을 계산하세요.
  • p-값을 계산하고 출력하세요. '적어도 관측값만큼 극단적인' 경우는 검정 통계량이 관측값 이상인 경우로 정의합니다.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Compute the observed test statistic
mean_dt_diff = ____ - ____

# Shift the post-2010 data to have the same mean as the pre-2010 data
dt_post_shift = ____ - ____ + ____

# Compute 10,000 bootstrap replicates from arrays
bs_reps_pre = ____
bs_reps_post = ____

# Get replicates of difference of means
bs_reps = ____ - ____

# Compute and print the p-value
p_val = ____(____ >= ____) / 10000
print('p =', p_val)
코드 편집 및 실행