Đi từng bước qua phép hoán vị
Để giúp bạn hiểu đoạn mã dùng để tạo phân phối ngẫu nhiên, bài tập này sẽ dẫn bạn đi qua các bước trong khung làm việc infer. Cụ thể, bạn sẽ thấy cách khác biệt giữa các bản lặp được tạo ra ảnh hưởng đến các thống kê được tính như thế nào.
Sau khi chạy các bước infer, nhớ để ý rằng các con số hơi khác nhau giữa mỗi bản lặp.
Bài tập này là một phần của khóa học
Nền tảng Suy luận trong R
Hướng dẫn bài tập
Các gói dplyr và infer đã được nạp sẵn cho bạn, cùng với data frame disc từ bài trước.
- Gọi các hàm cho ba bước đầu tiên. Công việc đã được chuẩn bị sẵn, nhiệm vụ của bạn là khảo sát kết quả của việc gọi ba bước đầu trong
infer. - Để thấy được hiệu ứng của việc hoán vị,
- nhóm data frame đã hoán vị,
disc_perm, theo biếnreplicatemới, rồi - đếm các biến quan tâm (
promotetrong từngsex) bằngcount().
- nhóm data frame đã hoán vị,
- Với
disc_perm, dùngcalculate()để tính thống kê quan tâm. Đặtstatlà"diff in props"vàorderlàc("male", "female").
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Replicate the entire data frame, permuting the promote variable
disc_perm <- disc %>%
specify(promote ~ sex, success = "promoted") %>%
hypothesize(null = "independence") %>%
generate(reps = 5, type = "permute")
disc_perm %>%
# Group by replicate
___ %>%
# Count per group
___
disc_perm %>%
# Calculate difference in proportion, male then female
___