การเปลี่ยนแปลงของค่าสัมประสิทธิ์
เมื่อเข้าใจค่าสัมประสิทธิ์ของโมเดล LogisticRegression() แล้ว ลองศึกษาให้ลึกขึ้นว่าค่าเหล่านี้เปลี่ยนแปลงอย่างไรเมื่อใช้คอลัมน์ต่างชุดกันในการเทรน คำถามคือ ค่าสัมประสิทธิ์ของแต่ละคอลัมน์จะแตกต่างกันระหว่างโมเดลหรือไม่?
ให้ใช้ .fit() เทรนโมเดล LogisticRegression() สองโมเดลโดยใช้กลุ่มคอลัมน์ที่ต่างกัน แล้วพิจารณาด้วยว่าความแตกต่างนี้อาจส่งผลต่อความน่าจะเป็นของการผิดนัดชำระหนี้อย่างไร
ชุดข้อมูล cr_loan_clean ถูกโหลดเข้า workspace แล้ว พร้อมกับชุดข้อมูลสำหรับเทรน X1_train, X2_train และ y_train
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การสร้างโมเดลความเสี่ยงด้านเครดิตด้วย Python
คำแนะนำการฝึกหัด
- ตรวจสอบ 5 แถวแรกของชุดข้อมูลเทรน
Xทั้งสองชุด - เทรนโมเดล logistic regression ชื่อ
clf_logistic1ด้วยชุดข้อมูลเทรนX1 - เทรนโมเดล logistic regression ชื่อ
clf_logistic2ด้วยชุดข้อมูลเทรนX2 - แสดงค่าสัมประสิทธิ์ของโมเดล logistic regression ทั้งสองโมเดล
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Print the first five rows of each training set
print(____.____())
print(____.____())
# Create and train a model on the first training data
____ = ____(solver='lbfgs').____(____, np.ravel(y_train))
# Create and train a model on the second training data
____ = ____(solver='lbfgs').____(____, np.ravel(y_train))
# Print the coefficients of each model
print(____.____)
print(____.____)