शुरू करेंमुफ़्त में शुरू करें

रूसी ट्वीट्स के कैरेक्टर काउंट

इस अभ्यास में, आपको एक डेटाफ़्रेम tweets दिया गया है जिसमें रूस की Internet Research Agency से जुड़े कुछ ट्वीट्स शामिल हैं, जिन्हें FiveThirtyEight ने संकलित किया है.

आपका काम tweets में एक नया फीचर 'char_count' बनाना है, जो हर ट्वीट के कैरेक्टर्स की संख्या निकाले. साथ ही, हर ट्वीट की औसत लंबाई भी 계산 करें. ट्वीट्स tweets के content फीचर में उपलब्ध हैं.

ध्यान दें कि यह Twitter का वास्तविक डेटा है, इसलिए इसमें आपत्तिजनक भाषा या अन्य आपत्तिजनक सामग्री होने का जोखिम रहता है (इस अभ्यास में, और आगे आने वाले ऐसे किसी भी अभ्यास में जहाँ वास्तविक Twitter डेटा का उपयोग हो).

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python में NLP के लिए Feature Engineering

पाठ्यक्रम देखें

अभ्यास निर्देश

  • tweets के 'content' फीचर पर len अप्लाई करके नया फीचर char_count बनाइए.
  • 'char_count' फीचर का mean निकालकर ट्वीट्स का औसत कैरेक्टर काउंट प्रिंट कीजिए.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Create a feature char_count
tweets['char_count'] = tweets[____].apply(____)

# Print the average character count
print(tweets[____].____)
कोड संपादित करें और चलाएँ