शुरू करेंमुफ़्त में शुरू करें

डेटा को चंक्स में लोड करने के लिए जेनरेटर लिखना (3)

बहुत बढ़िया! आपने अभी एक जेनरेटर फंक्शन बनाया है जो बड़े फाइलों को प्रोसेस करने में आपकी मदद करेगा.

अब आइए उसी जेनरेटर फंक्शन का इस्तेमाल करके World Bank डेटासेट को पहले की तरह प्रोसेस करें. आप फाइल को लाइन-बाय-लाइन पढ़ेंगे और एक डिक्शनरी बनाएँगे जिसमें किसी कॉलम में हर देश कितनी बार आता है, उसकी गिनती होगी. लेकिन इस अभ्यास में आप सिर्फ 1000 पंक्तियाँ नहीं, बल्कि पूरा डेटासेट प्रोसेस करेंगे!

जेनरेटर फंक्शन read_large_file() और csv फाइल 'world_dev_ind.csv' पहले से लोड हैं और उपयोग के लिए तैयार हैं. शुरू कीजिए!

यह अभ्यास पाठ्यक्रम का हिस्सा है

Python टूलबॉक्स

पाठ्यक्रम देखें

अभ्यास निर्देश

  • कॉन्टेक्स्ट मैनेजर में open() के साथ 'world_dev_ind.csv' फाइल को file से बाँधें.
  • for लूप को पूरा करें ताकि वह read_large_file() को कॉल से मिलने वाले जेनरेटर पर इटरेट करे और फाइल की सभी पंक्तियाँ प्रोसेस करे.

इंटरैक्टिव व्यावहारिक अभ्यास

इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।

# Initialize an empty dictionary: counts_dict
counts_dict = {}

# Open a connection to the file
with ____ as ____:

    # Iterate over the generator from read_large_file()
    for line in ____:

        row = line.split(',')
        first_col = row[0]

        if first_col in counts_dict.keys():
            counts_dict[first_col] += 1
        else:
            counts_dict[first_col] = 1

# Print            
print(counts_dict)
कोड संपादित करें और चलाएँ