การวิเคราะห์ข้อมูลเบื้องต้น
ก่อนจะเข้าสู่รายละเอียดของ pipeline และการประมวลผลข้อมูลล่วงหน้า มาสำรวจ ชุดข้อมูลราคาบ้าน Ames ในรูปแบบดั้งเดิมที่ยังไม่ผ่านการประมวลผลกันก่อน ในบทก่อนหน้า เราได้จัดเตรียมข้อมูลให้แล้วเพื่อให้โฟกัสที่แนวคิดหลักของ XGBoost ได้เต็มที่ แต่ในบทนี้จะได้ลองทำการประมวลผลข้อมูลด้วยตัวเอง!
ชุดข้อมูลดั้งเดิมเวอร์ชันย่อได้ถูกโหลดไว้ใน pandas DataFrame ชื่อ df แล้ว ให้สำรวจ df ใน Shell แล้วเลือกตัวเลือกที่ ไม่ถูกต้อง จุดประสงค์หลักของแบบฝึกหัดนี้คือเพื่อทำความเข้าใจว่าต้องแปลงข้อมูลในลักษณะใดบ้างก่อนนำไปใช้กับ XGBoost
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Extreme Gradient Boosting with XGBoost
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด