พยากรณ์ความน่าจะเป็นของรีวิวภาพยนตร์
ในแบบฝึกหัดนี้ จะได้สร้างโมเดล logistic regression โดยใช้ชุดข้อมูล movies โดยที่ป้ายกำกับถูกเก็บอยู่ในอาร์เรย์ y และฟีเจอร์อยู่ใน X
ฝึกโมเดลด้วยข้อมูลเทรน แทนที่จะพยากรณ์คลาส ให้พยากรณ์ความน่าจะเป็นที่แต่ละอินสแตนซ์ในชุดทดสอบจะอยู่ในแต่ละคลาสจากสองคลาส
ฟังก์ชัน logistic regression และฟังก์ชันแบ่งข้อมูลเทรน/ทดสอบได้ถูก import มาให้แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Sentiment Analysis ด้วย Python
คำแนะนำการฝึกหัด
- แบ่งข้อมูลออกเป็นชุดเทรนและชุดทดสอบ
- ฝึกโมเดล logistic regression
- พยากรณ์ความน่าจะเป็นสำหรับคลาส 0 และคลาส 1 ของข้อมูลทดสอบ โดยคลาส 0 อยู่ในคอลัมน์แรกของความน่าจะเป็นที่พยากรณ์ได้ และคลาส 1 อยู่ในคอลัมน์ที่สอง
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)
# Train a logistic regression
log_reg = ____.____
# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]
print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])