ค้นหาผู้ฉ้อโกงจากหัวข้อที่พบ
ในแบบฝึกหัดนี้ คุณจะเชื่อมโยงผลลัพธ์จาก topic model กลับไปยังข้อมูลต้นฉบับ จากที่เรียนมา เราต้องการตั้งค่าสถานะ ข้อมูลทั้งหมดที่เกี่ยวข้องกับ topic 3 ซึ่งในทางปฏิบัติแล้วไม่ได้ตรงไปตรงมานัก ฟังก์ชัน get_topic_details() จะถูกกำหนดให้พร้อมใช้งาน โดยรับอาร์กิวเมนต์ ldamodel และ corpus เพื่อดึงรายละเอียดของแต่ละหัวข้อสำหรับข้อความแต่ละบรรทัด จากนั้นสามารถนำผลลัพธ์ไปผนวกกลับเข้ากับข้อมูลต้นฉบับได้ หากต้องการศึกษาเพิ่มเติมเกี่ยวกับการใช้งานผลลัพธ์จากโมเดล ซึ่งอยู่นอกเหนือขอบเขตของคอร์สนี้ แนะนำให้อ่านบทความนี้
ตัวแปรที่เตรียมไว้ให้ ได้แก่ dictionary และ corpus ข้อมูลข้อความ text_clean รวมถึงผลลัพธ์จากโมเดล ldamodel และฟังก์ชัน get_topic_details() ที่กำหนดไว้แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การตรวจจับการฉ้อโกงด้วย Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Run get_topic_details function and check the results
print(get_topic_details(____, ____))