เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

การ Fit โมเดล LDA

ถึงเวลาสร้าง topic model แรกของคุณแล้ว! ดังที่ได้กล่าวไว้ อาร์กิวเมนต์เพิ่มเติมสามตัวของฟังก์ชัน LDA() มีความสำคัญอย่างมากต่อการรัน topic model ให้ถูกต้อง โปรดทราบว่าการรันฟังก์ชัน LDA() อาจใช้เวลาประมาณ 10 วินาที แพ็กเกจ tidyverse และ tidytext รวมถึงชุดข้อมูล tidy_twitter ถูกโหลดไว้ให้แล้ว

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การวิเคราะห์ข้อความเบื้องต้นใน R

ดูคอร์ส

คำแนะนำการฝึกหัด

  • โหลดแพ็กเกจ topicmodels
  • แปลงจำนวนคำในแต่ละทวีตให้เป็น DTM
  • รัน LDA โดยกำหนด 2 หัวข้อและใช้ Gibbs sampler

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำ

ลองทำแบบฝึกหัดนี้โดยเติมโค้ดตัวอย่างนี้ให้สมบูรณ์

# Load the topicmodels package
___

# Cast the word counts by tweet into a DTM
dtm_twitter <- ___ %>% 
  ___(___) %>% 
  ___(___)

# Run an LDA with 2 topics and a Gibbs sampler
lda_out <- LDA(
  ___,
  k = ___,
  method = ___,
  control = list(seed = 42)
)
แก้ไขและรันโค้ด