การสุ่มตัวอย่างข้อมูล NHANES ใหม่
ข้อมูล NHANES เก็บรวบรวมจากกลุ่มตัวอย่าง (บุคคล) ที่คัดเลือกมาเพื่อให้เป็นตัวแทนของประชากรในสหรัฐฯ อย่างไรก็ตาม ลองสุ่มตัวอย่างจากชุดข้อมูล nhanes_final ด้วยวิธีต่าง ๆ เพื่อทำความเข้าใจวิธีการสุ่มแต่ละรูปแบบ
การสุ่มแบบง่าย (simple random sample) ทำได้โดยใช้ slice_sample() จาก dplyr ซึ่งรับข้อมูลชุดข้อมูลและจำนวนแถวที่ต้องการสุ่มเป็น integer
การสุ่มแบบแบ่งชั้น (stratified sampling) ทำได้โดยใช้ group_by() ร่วมกับ slice_sample() ฟังก์ชันจะสุ่ม n รายการจากแต่ละกลุ่มที่กำหนดใน group_by()
ฟังก์ชัน cluster() จากแพ็กเกจ sampling ใช้สร้างตัวอย่างแบบคลัสเตอร์ โดยรับชื่อชุดข้อมูล ตัวแปรที่จะใช้เป็นตัวแปรคลัสเตอร์ในรูปแบบเวกเตอร์ที่มีชื่อเป็น string (เช่น c("variable")) จำนวนคลัสเตอร์ที่ต้องการเลือก และวิธีการสุ่ม
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การออกแบบการทดลองใน R
คำแนะนำการฝึกหัด
- ใช้
slice_sample()เพื่อเลือก 2500 การสังเกตจากnhanes_finalแล้วบันทึกเป็นnhanes_srs - สร้าง
nhanes_stratifiedโดยใช้group_by()และslice_sample()แบ่งชั้นตามriagendrและเลือก 2000 รายการจากแต่ละเพศ จากนั้นตรวจสอบผลลัพธ์โดยใช้count()กับตัวแปรเพศของnhanes_stratified - โหลดแพ็กเกจ
samplingแล้วใช้cluster()แบ่งnhanes_finalตาม"indhhin2"ออกเป็น 6 คลัสเตอร์ด้วยวิธี"srswor"และกำหนดให้กับnhanes_cluster
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Use slice_sample() to create nhanes_srs
nhanes_srs <- ___ %>% ___(n=___)
# Create nhanes_stratified with group_by() and slice_sample()
___ <- ___ %>% group_by(___) %>% ___(n=___)
nhanes_stratified %>% ___
# Load sampling package and create nhanes_cluster with cluster()
___
nhanes_cluster <- cluster(___, "___", 6, method = "srswor")