เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

พยากรณ์ความน่าจะเป็นของรีวิวภาพยนตร์

ในแบบฝึกหัดนี้ จะได้สร้างโมเดล logistic regression โดยใช้ชุดข้อมูล movies โดยที่ป้ายกำกับถูกเก็บอยู่ในอาร์เรย์ y และฟีเจอร์อยู่ใน X

ฝึกโมเดลด้วยข้อมูลเทรน แทนที่จะพยากรณ์คลาส ให้พยากรณ์ความน่าจะเป็นที่แต่ละอินสแตนซ์ในชุดทดสอบจะอยู่ในแต่ละคลาสจากสองคลาส

ฟังก์ชัน logistic regression และฟังก์ชันแบ่งข้อมูลเทรน/ทดสอบได้ถูก import มาให้แล้ว

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Sentiment Analysis ด้วย Python

ดูคอร์ส

คำแนะนำการฝึกหัด

  • แบ่งข้อมูลออกเป็นชุดเทรนและชุดทดสอบ
  • ฝึกโมเดล logistic regression
  • พยากรณ์ความน่าจะเป็นสำหรับคลาส 0 และคลาส 1 ของข้อมูลทดสอบ โดยคลาส 0 อยู่ในคอลัมน์แรกของความน่าจะเป็นที่พยากรณ์ได้ และคลาส 1 อยู่ในคอลัมน์ที่สอง

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Split into training and testing
X_train, X_test, y_train, y_test = ____(___, ___, test_size=0.2, random_state=321)

# Train a logistic regression
log_reg = ____.____

# Predict the probability of the 0 class
prob_0 = log_reg.____[:, ____]
# Predict the probability of the 1 class
prob_1 = log_reg.____[:, ____]

print("First 10 predicted probabilities of class 0: ", prob_0[:10])
print("First 10 predicted probabilities of class 1: ", prob_1[:10])
แก้ไขและรันโค้ด