การ Fit โมเดล LDA
ถึงเวลาสร้าง topic model แรกของคุณแล้ว! ดังที่ได้กล่าวไว้ อาร์กิวเมนต์เพิ่มเติมสามตัวของฟังก์ชัน LDA() มีความสำคัญอย่างมากต่อการรัน topic model ให้ถูกต้อง โปรดทราบว่าการรันฟังก์ชัน LDA() อาจใช้เวลาประมาณ 10 วินาที แพ็กเกจ tidyverse และ tidytext รวมถึงชุดข้อมูล tidy_twitter ถูกโหลดไว้ให้แล้ว
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การวิเคราะห์ข้อความเบื้องต้นใน R
คำแนะนำการฝึกหัด
- โหลดแพ็กเกจ
topicmodels - แปลงจำนวนคำในแต่ละทวีตให้เป็น DTM
- รัน LDA โดยกำหนด 2 หัวข้อและใช้ Gibbs sampler
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ
ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์
# Load the topicmodels package
___
# Cast the word counts by tweet into a DTM
dtm_twitter <- ___ %>%
___(___) %>%
___(___)
# Run an LDA with 2 topics and a Gibbs sampler
lda_out <- LDA(
___,
k = ___,
method = ___,
control = list(seed = 42)
)