โมเดลที่ fit ดีที่สุดและแย่ที่สุด
ในแบบฝึกหัดนี้ คุณจะตอบคำถามต่อไปนี้:
- โดยรวมแล้ว โมเดลของคุณ fit กับข้อมูลได้ดีแค่ไหน?
- โมเดลใดที่ fit ได้ดีที่สุด?
- โมเดลใดที่ไม่ fit กับข้อมูล?
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Machine Learning ใน Tidyverse
คำแนะนำการฝึกหัด
- พล็อตฮิสโทแกรมของค่า \(R^2\) จากโมเดลทั้ง 77 โมเดล
- ดึงข้อมูลโมเดลที่ fit ดีที่สุด 4 อันดับแรก (อ้างอิงจาก \(R^2\)) และเก็บไว้ใน data frame ชื่อ
best_fit - ดึงข้อมูลโมเดลที่ fit แย่ที่สุด 4 อันดับแรก (อ้างอิงจาก \(R^2\)) และเก็บไว้ใน data frame ชื่อ
worst_fit
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Plot a histogram of rsquared for the 77 models
model_perf %>%
ggplot(aes(x = ___)) +
___()
# Extract the 4 best fitting models
best_fit <- model_perf %>%
slice_max(___, n = ___)
# Extract the 4 models with the worst fit
worst_fit <- model_perf %>%
slice_min(___, n = ___)