रूसी ट्वीट्स के कैरेक्टर काउंट
इस अभ्यास में, आपको एक डेटाफ़्रेम tweets दिया गया है जिसमें रूस की Internet Research Agency से जुड़े कुछ ट्वीट्स शामिल हैं, जिन्हें FiveThirtyEight ने संकलित किया है.
आपका काम tweets में एक नया फीचर 'char_count' बनाना है, जो हर ट्वीट के कैरेक्टर्स की संख्या निकाले. साथ ही, हर ट्वीट की औसत लंबाई भी 계산 करें. ट्वीट्स tweets के content फीचर में उपलब्ध हैं.
ध्यान दें कि यह Twitter का वास्तविक डेटा है, इसलिए इसमें आपत्तिजनक भाषा या अन्य आपत्तिजनक सामग्री होने का जोखिम रहता है (इस अभ्यास में, और आगे आने वाले ऐसे किसी भी अभ्यास में जहाँ वास्तविक Twitter डेटा का उपयोग हो).
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में NLP के लिए Feature Engineering
अभ्यास निर्देश
tweetsके 'content' फीचर परlenअप्लाई करके नया फीचरchar_countबनाइए.- 'char_count' फीचर का mean निकालकर ट्वीट्स का औसत कैरेक्टर काउंट प्रिंट कीजिए.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Create a feature char_count
tweets['char_count'] = tweets[____].apply(____)
# Print the average character count
print(tweets[____].____)