เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

ทดสอบแนวคิดจาก Kaggle Forum

น่าเสียดายที่โพสต์ใน Forum และ Kernel ไม่ได้มีประโยชน์กับโมเดลของคุณทุกชิ้น ดังนั้นแทนที่จะนำแนวคิดต่าง ๆ มาใส่ใน pipeline โดยไม่ไตร่ตรอง ควรทดสอบก่อนเสมอ

มีฟังก์ชัน get_cv_score() ให้พร้อมใช้งาน ซึ่งรับ train dataset เป็นอาร์กิวเมนต์และคืนค่า root mean squared error จากการ cross-validation แบบ 3-fold โดย DataFrame train ถูกโหลดไว้ใน workspace แล้ว

ลองนำข้อเสนอแนะต่าง ๆ จาก Kaggle Forum มาทดสอบ และดูว่าช่วยปรับปรุง validation score ได้หรือไม่

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การแข่งขัน Kaggle ด้วย Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Drop passenger_count column
new_train_1 = train.____('____', axis=1)

# Compare validation scores
initial_score = get_cv_score(train)
new_score = get_cv_score(new_train_1)

print('Initial score is {} and the new score is {}'.format(initial_score, new_score))
แก้ไขและรันโค้ด