अन्य flat files से डेटा लाएँ
हालाँकि CSVs सबसे आम flat file हैं, कभी-कभी आपको अलग-अलग डिलीमीटर वाले फाइल मिलेंगे. read_csv() sep कीवर्ड आर्ग्युमेंट की मदद से इन सभी को लोड कर सकता है. डिफॉल्ट रूप से, pandas मानता है कि सेपरेटर कॉमा है, यही कारण है कि CSVs के लिए हमें sep बताने की ज़रूरत नहीं होती.
यहाँ मौजूद Vermont टैक्स डेटा वाला वर्ज़न एक tab-separated values फाइल (TSV) है, इसलिए फाइल पढ़ते समय सही डिलीमीटर पास करने के लिए आपको sep का उपयोग करना होगा. ध्यान रखें कि tabs को \t से दर्शाया जाता है. फाइल लोड हो जाने के बाद, बाकी का कोड N1 फ़ील्ड, जिसमें आय-श्रेणी (income range) कैटेगरीज़ होती हैं, के आधार पर ग्रुप करता है ताकि आय श्रेणी के अनुसार टैक्स रिटर्न का चार्ट बनाया जा सके.
यह अभ्यास पाठ्यक्रम का हिस्सा है
pandas के साथ सरल Data Ingestion
अभ्यास निर्देश
pandasकोpdउपनाम (alias) के साथ import करें.vt_tax_data_2016.tsvलोड करें औरsepकीवर्ड आर्ग्युमेंट से सही डिलीमीटर सेट करें.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
# Import pandas with the alias pd
____
# Load TSV using the sep keyword argument to set delimiter
data = ____(____, ____)
# Plot the total number of tax returns by income group
counts = data.groupby("agi_stub").N1.sum()
counts.plot.bar()
plt.show()