प्रोडक्ट के अनुसार काउंट करना और पुन:क्रमित करना
tidy_twitter को tokenize किया जा चुका है और stop words, जिनमें custom stop words भी शामिल हैं, हटा दिए गए हैं. आप complaints और non-complaints के आधार पर word counts के अंतर को visualise करना चाहते हैं.
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Text Analysis परिचय
अभ्यास निर्देश
- यह देखें कि complaint है या नहीं, उसके आधार पर शब्दों की गिनती करें.
- complaint है या नहीं, इसके आधार पर शीर्ष 20 शब्द रखें.
- count के आधार पर word को factor के रूप में पुन:क्रमित करने से पहले ungroup करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
word_counts <- tidy_twitter %>%
# Count words by whether or not its a complaint
___(___, ___) %>%
# Group by whether or not its a complaint
group_by(___) %>%
# Keep the top 20 words
___(___, ___) %>%
# Ungroup before reordering word as a factor by the count
___() %>%
___(word2 = ___(___, ___))