ซ้อนทับเส้นกราฟ
ต่อจากแบบฝึกหัดก่อนหน้า คราวนี้จะทำซ้ำกระบวนการสุ่มตัวอย่าง 100 ครั้ง เพื่อแสดงภาพการกระจายตัวของเส้นถดถอยที่ได้จากตัวอย่างสุ่ม 100 ชุดที่แตกต่างกัน
แทนที่จะเรียก sample_n() ซ้ำๆ เหมือนในแบบฝึกหัดที่แล้ว ฟังก์ชัน rep_sample_n() จากแพ็กเกจ oilabs ช่วยให้สร้างตัวอย่างสุ่มหลายชุดได้สะดวกยิ่งขึ้น โดย rep_sample_n() จะทำซ้ำคำสั่ง sample_n() ตามจำนวนที่กำหนดในอาร์กิวเมนต์ reps
ฟังก์ชัน do() จาก dplyr ช่วยให้รันคำสั่ง lm แยกกันสำหรับแต่ละระดับของตัวแปรที่ถูก group_by ไว้ ในที่นี้ตัวแปรกลุ่มคือรอบการสุ่มตัวอย่าง ดังนั้น lm แต่ละตัวจึงรันบนชุดข้อมูลสุ่มที่แตกต่างกัน
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การอนุมานสำหรับการถดถอยเชิงเส้นใน R
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Set the seed for reproducibility
set.seed(4747)
# Repeatedly sample the population without replacement
many_samples <- popdata %>%
___
# See the result
glimpse(many_samples)