เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

เลือกตัวชี้วัดคุณภาพให้ถูกต้อง

วิศวกรระดับจูเนียร์ของ Global Retail Analytics รัน cleaning pipeline กับไฟล์ online_retail ที่อัปโหลดใหม่ แต่ลืมคอมเมนต์บรรทัด na.drop(subset=["CustomerID"]) ออกโดยไม่ตั้งใจ ขั้นตอนที่เหลือ ได้แก่ na.fill(), dropDuplicates() และตัวกรองเรคอร์ดที่ไม่ถูกต้อง — ทั้งหมดรันสำเร็จโดยไม่มีข้อผิดพลาด

ตัวชี้วัดคุณภาพใดที่จะเปิดเผยข้อผิดพลาดนี้ได้ทันที?

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

การแปลงข้อมูลด้วย Spark SQL ใน Databricks

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง

เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา

เริ่มแบบฝึกหัด