डेटा को चंक्स में लोड करने के लिए एक इटरेटर लिखना (1)
मेमोरी में एक साथ फिट न होने वाले बड़े डेटा को चंक्स में पढ़ने का एक और तरीका है कि फ़ाइल को निश्चित लंबाई के DataFrames में पढ़ा जाए, जैसे 100. उदाहरण के लिए, pandas पैकेज (जिसे pd के रूप में इम्पोर्ट किया गया है) के साथ आप pd.read_csv(filename, chunksize=100) कर सकते हैं. यह एक iterable रीडर ऑब्जेक्ट बनाता है, जिसका मतलब है कि आप उस पर next() का उपयोग कर सकते हैं.
इस अभ्यास में, आप read_csv() के साथ फ़ाइल को छोटे-छोटे DataFrame चंक्स में पढ़ेंगे. आप अपने करंट डायरेक्टरी में उपलब्ध World Bank Indicators डेटा 'ind_pop.csv' का उपयोग करेंगे, ताकि कई देशों और वर्षों के लिए शहरी जनसंख्या इंडिकेटर को देख सकें.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python टूलबॉक्स
अभ्यास निर्देश
pd.read_csv()का उपयोग करके'ind_pop.csv'को साइज 10 के चंक्स में पढ़ें. परिणाम कोdf_readerमें असाइन करें.df_readerसे पहले दो चंक्स को प्रिंट करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Import the pandas package
import pandas as pd
# Initialize reader object: df_reader
df_reader = ____(____, ____)
# Print two chunks
print(____)
print(____)