शुरू करेंमुफ़्त में शुरू करें

यूज़र प्रकारों की गिनती

श्रेणीबद्ध डेटा के लिए गिनतियाँ सबसे बुनियादी सारांश होती हैं. क्योंकि टेक्स्ट श्रेणीबद्ध होता है, इसलिए गिनतियाँ निकालने में सहज होना ज़रूरी है. twitter_data में शिकायतें और गैर-शिकायतें शामिल हैं, जैसा कि complaint_label कॉलम से संकेत मिलता है, और इसमें एक कॉलम usr_verified भी है जो बताता है कि यूज़र वेरिफ़ाइड है या नहीं (अर्थात् Twitter ने पुष्टि की है कि वे वही हैं जो वे कहते हैं). ध्यान दें, यह कॉलम <lgl> टाइप का है, यानी logical. क्या वेरिफ़ाइड यूज़र ज़्यादा शिकायत करते हैं?

यह अभ्यास पाठ्यक्रम का हिस्सा है

R में Text Analysis परिचय

पाठ्यक्रम देखें

अभ्यास निर्देश

  • tidyverse पैकेज लोड करें, जिसमें dplyr और ggplot2 शामिल हैं.
  • डेटा फ़िल्टर करें ताकि केवल शिकायत वाले ट्वीट्स ही रहें.
  • शिकायत करने वाले वेरिफ़ाइड और नॉन-वेरिफ़ाइड यूज़र्स की संख्या गिनें.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Load the tidyverse package
___(___)

twitter_data %>% 
  # Filter for just the complaints
  ___(___) %>% 
  # Count the number of verified and non-verified users
  ___(___)
कोड संपादित करें और चलाएँ