Parse errors को नज़रअंदाज़ करना
एक गलत मान, यानी literal टेक्स्ट "unknown", वेंडर एक्सपोर्ट के checkouts कॉलम में घुस आया है. जब कोई मान inferred dtype में पार्स नहीं होता, तो Polars सामान्यतः फेल हो जाता है. Polars को निर्देश दें कि वह ऐसी त्रुटियों को स्किप करे ताकि टीम बाकी डेटा फिर भी लोड कर सके.
आपके लिए एक सामान्य रो और गलत मान वाली रो प्रिंट की गई है ताकि आप समझ सकें कि क्या हो रहा है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Polars के साथ Data Pipelines का स्केलिंग और ऑप्टिमाइज़ेशन
अभ्यास निर्देश
- वह argument जोड़ें जो Polars को गलत मानों को
nullपर सेट करके स्कैन जारी रखने के लिए कहता है.
इंटरैक्टिव व्यावहारिक अभ्यास
इस अभ्यास को इस नमूना कोड को पूरा करके आज़माएँ।
result = pl.scan_csv(
MESSY_CSV_PATH,
separator=";",
skip_rows=2,
schema_overrides={
"checkouts": pl.Int64,
"branch_code": pl.String,
},
# Tolerate values that don't fit the schema
____=____,
).collect()
print(result)