Bringing it all together (1)
पिछले अभ्यासों में आपने अपने खुद के फंक्शन लिखने की शुरुआती समझ पाई। आपने सीखा कि किस तरह अपने फंक्शन डेफिनिशन में पैरामीटर जोड़ते हैं, ट्यूपल्स के साथ एक या कई वैल्यू रिटर्न करते हैं, और आपने जो फंक्शन परिभाषित किए हैं उन्हें कैसे कॉल करते हैं.
इस और अगले अभ्यास में, आप इन सभी कॉन्सेप्ट्स को साथ लाकर एक सरल डेटा साइंस समस्या पर लागू करेंगे। आप एक डेटासेट लोड करेंगे और डेटा से साधारण इनसाइट्स निकालने के लिए कुछ फ़ंक्शनलिटी विकसित करेंगे.
इस अभ्यास में आपका लक्ष्य है याद करना कि डेटासेट को DataFrame में कैसे लोड किया जाता है। डेटासेट में Twitter का डेटा है और आप एक कॉलम की एंट्रीज़ पर इटरेट करेंगे ताकि एक डिक्शनरी बना सकें जिसमें कुंजियाँ भाषाओं के नाम हों और मान उस भाषा में ट्वीट्स की संख्या। फ़ाइल tweets.csv आपके करंट डायरेक्टरी में उपलब्ध है.
ध्यान दें: यह Twitter का वास्तविक डेटा है, इसलिए इसमें अभद्र भाषा या आपत्तिजनक सामग्री होने का जोखिम रहता है (इस अभ्यास में, और उन आगे के अभ्यासों में भी जो वास्तविक Twitter डेटा का उपयोग करते हैं).
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Functions का परिचय
अभ्यास निर्देश
- pandas पैकेज को उपनाम
pdके साथ इम्पोर्ट करें. - pandas के फंक्शन
read_csv()का उपयोग करके फ़ाइल'tweets.csv'इम्पोर्ट करें। प्राप्त DataFrame कोdfमें असाइन करें. - DataFrame
dfके'lang'कॉलम यानीcolपर इटरेट करते हुएforलूप को पूरा करें. forलूप मेंif-elseस्टेटमेंट्स के बॉडी पूरी करें: if कुंजी डिक्शनरीlangs_countमें है, तो उस कुंजी के मान में1जोड़ें; else उस कुंजी कोlangs_countमें जोड़ें और संबंधित मान1सेट करें। अपने कोड में लूप वैरिएबलentryका उपयोग करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Import pandas
# Import Twitter data as DataFrame: df
df = ____
# Initialize an empty dictionary: langs_count
langs_count = {}
# Extract column from DataFrame: col
col = df['lang']
# Iterate over lang column in DataFrame
for entry in ____:
# If the language is in langs_count, add 1
if entry in langs_count.keys():
____
# Else add the language to langs_count, set the value to 1
else:
____
# Print the populated dictionary
print(langs_count)