เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การสุ่มตัวอย่างข้อมูล NHANES ใหม่

ข้อมูล NHANES เก็บรวบรวมจากกลุ่มตัวอย่าง (บุคคล) ที่คัดเลือกมาเพื่อให้เป็นตัวแทนของประชากรในสหรัฐฯ อย่างไรก็ตาม ลองสุ่มตัวอย่างจากชุดข้อมูล nhanes_final ด้วยวิธีต่าง ๆ เพื่อทำความเข้าใจวิธีการสุ่มแต่ละรูปแบบ

การสุ่มแบบง่าย (simple random sample) ทำได้โดยใช้ slice_sample() จาก dplyr ซึ่งรับข้อมูลชุดข้อมูลและจำนวนแถวที่ต้องการสุ่มเป็น integer

การสุ่มแบบแบ่งชั้น (stratified sampling) ทำได้โดยใช้ group_by() ร่วมกับ slice_sample() ฟังก์ชันจะสุ่ม n รายการจากแต่ละกลุ่มที่กำหนดใน group_by()

ฟังก์ชัน cluster() จากแพ็กเกจ sampling ใช้สร้างตัวอย่างแบบคลัสเตอร์ โดยรับชื่อชุดข้อมูล ตัวแปรที่จะใช้เป็นตัวแปรคลัสเตอร์ในรูปแบบเวกเตอร์ที่มีชื่อเป็น string (เช่น c("variable")) จำนวนคลัสเตอร์ที่ต้องการเลือก และวิธีการสุ่ม

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การออกแบบการทดลองใน R

ดูคอร์ส

คำแนะนำการฝึกหัด

  • ใช้ slice_sample() เพื่อเลือก 2500 การสังเกตจาก nhanes_final แล้วบันทึกเป็น nhanes_srs
  • สร้าง nhanes_stratified โดยใช้ group_by() และ slice_sample() แบ่งชั้นตาม riagendr และเลือก 2000 รายการจากแต่ละเพศ จากนั้นตรวจสอบผลลัพธ์โดยใช้ count() กับตัวแปรเพศของ nhanes_stratified
  • โหลดแพ็กเกจ sampling แล้วใช้ cluster() แบ่ง nhanes_final ตาม "indhhin2" ออกเป็น 6 คลัสเตอร์ด้วยวิธี "srswor" และกำหนดให้กับ nhanes_cluster

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Use slice_sample() to create nhanes_srs
nhanes_srs <- ___ %>% ___(n=___)

# Create nhanes_stratified with group_by() and slice_sample()
___ <- ___ %>% group_by(___) %>% ___(n=___)
nhanes_stratified %>% ___

# Load sampling package and create nhanes_cluster with cluster()
___
nhanes_cluster <- cluster(___, "___", 6, method = "srswor")
แก้ไขและรันโค้ด