Tính sai số biên theo nhóm
Một cách để giảm sai số biên trong phân tích ACS là gộp các ước lượng khi phù hợp. Bạn có thể làm điều này với các công cụ phân tích dữ liệu theo nhóm của tidyverse. Trong bài tập này, bạn sẽ gộp các ước lượng về tỷ lệ nghèo của người cao tuổi nam và nữ ở Vermont, và dùng hàm moe_sum() như một phần của phân tích theo nhóm. Cách làm này có thể làm mất đi một số chi tiết, nhưng các ước lượng của bạn sẽ đáng tin cậy hơn so với sai số biên của chúng so với trước khi gộp.
Bài tập này là một phần của khóa học
Phân tích dữ liệu Điều tra Dân số Hoa Kỳ bằng R
Hướng dẫn bài tập
- Nhóm bộ dữ liệu
vt_eldpovtheo cột GEOID. - Trong lệnh
summarize(), sử dụng hàmmoe_sum()để tính sai số biên tổng hợp. - Kiểm tra tỷ lệ hàng có sai số biên lớn hơn ước lượng tương ứng.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Group the dataset and calculate a derived margin of error
vt_eldpov2 <- vt_eldpov %>%
___(___) %>%
summarize(
estmf = sum(estimate),
moemf = ___(___ = moe, estimate = estimate)
)
# Filter rows where newly-derived margin of error exceeds newly-derived estimate
moe_check2 <- filter(vt_eldpov2, ___ > estmf)
# Check proportion of rows where margin of error exceeds estimate
nrow(moe_check2) / ___(vt_eldpov2)