สองกลุ่มตัวอย่าง
หลังจากสร้างโมเดลการจำแนกประเภทหลายตัวจากชุดข้อมูล tic_tac_toe แล้ว คุณพบว่าบางโมเดลไม่สามารถ generalize ได้ดีเท่าที่ควร แม้จะแบ่งข้อมูลเป็น training set และ testing set ตามที่เรียนมาแล้วก็ตาม จึงสงสัยว่าเหตุใดกระบวนการ validation จึงไม่ได้ผลดีนัก
เมื่อลองแบ่งข้อมูล training และ test ด้วยวิธีอื่น พบว่าค่าความแม่นยำของโมเดลเปลี่ยนไป ก่อนที่จะหงุดหงิดกับผลลัพธ์ที่ไม่คงที่ ลองมาดูกันว่ายังมีปัจจัยอะไรอีกที่อาจส่งผลต่อเรื่องนี้
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การตรวจสอบความถูกต้องของโมเดลใน Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Create two different samples of 200 observations
sample1 = tic_tac_toe.____(____, random_state=1111)
sample2 = tic_tac_toe.____(____, random_state=1171)