Một p-value, theo hai cách
Bạn đã thấy rằng thường có hai cách để xây dựng phân phối giả thuyết rỗng: qua tính toán và qua xấp xỉ toán học. Kiểm định độ phù hợp chi-bình phương cũng không ngoại lệ. Phân phối xấp xỉ ở đây lại là "phân phối Chi-squared" với bậc tự do bằng số lượng nhóm trừ đi một.
Trong bài này, bạn sẽ so sánh hai cách tiếp cận này để tính p-value nhằm đo lường mức độ nhất quán giữa phân phối chữ số đầu tiên của Iran với Định luật Benford. Lưu ý: thống kê quan sát được mà bạn đã tạo ở bài trước được lưu trong không gian làm việc dưới tên chi_obs_stat.
Bài tập này là một phần của khóa học
Suy luận cho dữ liệu phân loại trong R
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Compute degrees of freedom
degrees_of_freedom <- ___ %>%
# Pull out first_digit vector
pull("first_digit") %>%
# Calculate n levels and subtract 1
___
# Plot both null dists
___
# Add density layer
___
# Add vertical line at obs stat
___
# Overlay chisq approx
stat_function(fun = dchisq, args = list(df = ___), color = "blue")