DTM बनाना
हमारे tidy_twitter डेटा का उपयोग करके एक document term matrix (DTM) बनाएँ. इस केस में, हर tweet को एक document माना गया है. कॉलम नामों की पुष्टि करने के लिए कंसोल में tidy_twitter प्रिंट करें.
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Text Analysis परिचय
अभ्यास निर्देश
- टाइड किए हुए Twitter डेटा से शुरू करें.
- हर tweet में इस्तेमाल हुए हर word की गिनती करें.
- tweet के word counts का उपयोग करके DTM बनाएँ.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Start with the tidied Twitter data
___ %>%
# Count each word used in each tweet
___(word, ___) %>%
# Use the word counts by tweet to create a DTM
cast_dtm(___, word, n)