टॉपिक्स का विज़ुअलाइज़ेशन
पिछले चैप्टर्स में जो सीखा है, उसका उपयोग करते हुए LDA द्वारा निकाले गए टॉपिक्स को विज़ुअलाइज़ करते हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Text Analysis परिचय
अभ्यास निर्देश
- टॉपिक के अनुसार सबसे अधिक शब्द प्रायिकता वाले टॉप 10 रखें.
term2बनाएँ, जोtermको शब्द प्रायिकता के आधार पर ऑर्डर करने वाला फैक्टर हो.term2और शब्द प्रायिकताओं को प्लॉट करें.- बार प्लॉट को टॉपिक के अनुसार (अर्थात
~) फेसिट करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
word_probs <- lda_topics %>%
# Keep the top 10 highest word probabilities by topic
___(___) %>%
___(___) %>%
___() %>%
# Create term2, a factor ordered by word probability
___(term2 = ___(___))
# Plot term2 and the word probabilities
___(___) +
geom_col() +
# Facet the bar plot by topic
___(___, scales = "free") +
coord_flip()