การแจกแจงตัวอย่างภายใต้สมมติฐานหลักของความชัน
ในบทที่แล้ว คุณได้ศึกษาการแจกแจงตัวอย่างของความชันจากประชากรที่มีค่าความชันไม่เท่ากับศูนย์ แต่โดยทั่วไปในการอนุมานเชิงสถิติ จำเป็นต้องรู้การแจกแจงตัวอย่างของความชันภายใต้สมมติฐานที่ว่าไม่มีความสัมพันธ์ระหว่างตัวแปรอธิบายและตัวแปรตอบสนอง นอกจากนี้ ในสถานการณ์ส่วนใหญ่ เราไม่ทราบประชากรต้นทางของข้อมูล ดังนั้นจึงต้องสร้างการแจกแจงตัวอย่างภายใต้สมมติฐานหลักจากชุดข้อมูลเดิมเท่านั้น
ในช่วงกลางศตวรรษที่ 20 มีการศึกษาที่ติดตามฝาแฝดเหมือนที่ถูกแยกจากกันตั้งแต่แรกเกิด โดยเด็กคนหนึ่งถูกเลี้ยงดูในบ้านของพ่อแม่ทางสายเลือด และอีกคนถูกเลี้ยงดูในครอบครัวอุปถัมภ์ เพื่อตอบคำถามว่าสติปัญญาเกิดจากพันธุกรรมหรือสภาพแวดล้อม เด็กทั้งสองจึงได้รับการทดสอบไอคิว ข้อมูลที่ได้แสดงค่าไอคิวของฝาแฝดที่เติบโตในครอบครัวอุปถัมภ์ (ตัวแปร Foster คือตัวแปรตอบสนอง) และค่าไอคิวของฝาแฝดที่เติบโตกับพ่อแม่ทางสายเลือด (ตัวแปร Biological คือตัวแปรอธิบาย)
ในแบบฝึกหัดนี้จะใช้ฟังก์ชัน pull() ซึ่งรับ data frame และคืนค่าคอลัมน์ที่เลือกในรูปแบบเวกเตอร์ (คล้ายกับการใช้ $)
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การอนุมานสำหรับการถดถอยเชิงเส้นใน R
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
library(infer)
# Calculate the observed slope
# Run a lin. reg. of Foster vs. Biological on the twins data
obs_slope <- ___(___, ___) %>%
# Tidy the result
___() %>%
# Filter for rows where term equal Biological
___(___) %>%
# Pull out the estimate column
___(___)
# See the result
obs_slope