เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

ซ้อนทับเส้นกราฟ

ต่อจากแบบฝึกหัดก่อนหน้า คราวนี้จะทำซ้ำกระบวนการสุ่มตัวอย่าง 100 ครั้ง เพื่อแสดงภาพการกระจายตัวของเส้นถดถอยที่ได้จากตัวอย่างสุ่ม 100 ชุดที่แตกต่างกัน

แทนที่จะเรียก sample_n() ซ้ำๆ เหมือนในแบบฝึกหัดที่แล้ว ฟังก์ชัน rep_sample_n() จากแพ็กเกจ oilabs ช่วยให้สร้างตัวอย่างสุ่มหลายชุดได้สะดวกยิ่งขึ้น โดย rep_sample_n() จะทำซ้ำคำสั่ง sample_n() ตามจำนวนที่กำหนดในอาร์กิวเมนต์ reps

ฟังก์ชัน do() จาก dplyr ช่วยให้รันคำสั่ง lm แยกกันสำหรับแต่ละระดับของตัวแปรที่ถูก group_by ไว้ ในที่นี้ตัวแปรกลุ่มคือรอบการสุ่มตัวอย่าง ดังนั้น lm แต่ละตัวจึงรันบนชุดข้อมูลสุ่มที่แตกต่างกัน

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การอนุมานสำหรับการถดถอยเชิงเส้นใน R

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Set the seed for reproducibility
set.seed(4747)

# Repeatedly sample the population without replacement
many_samples <- popdata %>%
  ___

# See the result
glimpse(many_samples)
แก้ไขและรันโค้ด