เหตุใด Explicit Schema จึงสำคัญ
คุณและเพื่อนร่วมงานที่ Global Retail Analytics ต่างโหลดไฟล์ customer_orders.csv แล้วรัน cleaning pipeline ชุดเดียวกัน แต่ได้ผลลัพธ์ที่แตกต่างกัน ภาพแสดงทั้งสองแนวทางเปรียบเทียบกัน
สาเหตุที่น่าจะเป็นไปได้มากที่สุดของความแตกต่างในจำนวนแถวคืออะไร?
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การแปลงข้อมูลด้วย Spark SQL ใน Databricks
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด