LDA आउटपुट को टाइडी करना
हमने पिछले अभ्यास से LDA आउटपुट lda_out लोड कर लिया है. आउटपुट में कई दिलचस्प चीजें हैं, लेकिन आम तौर पर टॉपिक्स सबसे अधिक महत्वपूर्ण होते हैं. आइए इन मानों को निकालते हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Text Analysis परिचय
अभ्यास निर्देश
glimpse()का उपयोग करके टॉपिक मॉडल आउटपुट का सारांश प्रिंट करें.- शब्द संभावनाओं की मैट्रिक्स को टाइडी करें.
- शब्द संभावनाओं के आधार पर टॉपिक्स को अवरोही क्रम में क्रमबद्ध करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Glimpse the topic model output
___(___)
# Tidy the matrix of word probabilities
lda_topics <- ___ %>%
___(__)
# Arrange the topics by word probabilities in descending order
___ %>%
___(___)