Kiểm tra sai số biên
Dữ liệu ACS khác với dữ liệu Tổng điều tra dân số theo thập niên ở chỗ chúng biểu diễn các ước tính kèm theo sai số biên. Mặc định, sai số biên của ACS tương ứng với mức tin cậy 90% quanh một ước tính, nghĩa là chúng ta chắc khoảng 90% rằng giá trị thực nằm trong khoảng bằng ước tính báo cáo cộng trừ sai số biên đã báo cáo.
Trong bài tập này, bạn sẽ thực hành làm việc với dữ liệu có sai số biên cao so với ước tính. Chúng ta sẽ dùng ví dụ về tỷ lệ nghèo của nhóm dân số từ 75 tuổi trở lên ở các Census tract tại Vermont.
Bài tập này là một phần của khóa học
Phân tích dữ liệu Điều tra Dân số Hoa Kỳ bằng R
Hướng dẫn bài tập
- Lấy một bộ dữ liệu về nghèo đói ở người cao tuổi theo Census tract tại Vermont từ ACS.
- Lọc khung dữ liệu để tạo một khung dữ liệu mới lưu các dòng có sai số biên lớn hơn ước tính tương ứng.
- Chia số dòng trong
moe_checkcho số dòng trong tập dữ liệu gốc để xem tỷ lệ các dòng có sai số biên lớn hơn ước tính.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Get data on elderly poverty by Census tract in Vermont
vt_eldpov <- ___(___ = "tract",
variables = c(eldpovm = "B17001_016",
eldpovf = "B17001_030"),
state = "VT")
vt_eldpov
# Identify rows with greater margins of error than their estimates
moe_check <- ___(vt_eldpov, moe > ___)
# Check proportion of rows where the margin of error exceeds the estimate
___(moe_check) / nrow(vt_eldpov)