यूज़र प्रकारों की गिनती
श्रेणीबद्ध डेटा के लिए गिनतियाँ सबसे बुनियादी सारांश होती हैं. क्योंकि टेक्स्ट श्रेणीबद्ध होता है, इसलिए गिनतियाँ निकालने में सहज होना ज़रूरी है. twitter_data में शिकायतें और गैर-शिकायतें शामिल हैं, जैसा कि complaint_label कॉलम से संकेत मिलता है, और इसमें एक कॉलम usr_verified भी है जो बताता है कि यूज़र वेरिफ़ाइड है या नहीं (अर्थात् Twitter ने पुष्टि की है कि वे वही हैं जो वे कहते हैं). ध्यान दें, यह कॉलम <lgl> टाइप का है, यानी logical. क्या वेरिफ़ाइड यूज़र ज़्यादा शिकायत करते हैं?
यह अभ्यास पाठ्यक्रम का हिस्सा है
R में Text Analysis परिचय
अभ्यास निर्देश
tidyverseपैकेज लोड करें, जिसमेंdplyrऔरggplot2शामिल हैं.- डेटा फ़िल्टर करें ताकि केवल शिकायत वाले ट्वीट्स ही रहें.
- शिकायत करने वाले वेरिफ़ाइड और नॉन-वेरिफ़ाइड यूज़र्स की संख्या गिनें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Load the tidyverse package
___(___)
twitter_data %>%
# Filter for just the complaints
___(___) %>%
# Count the number of verified and non-verified users
___(___)