สร้าง pipeline แบบหลายงานด้วย Job
ทีมของคุณที่ Global Retail Analytics ได้แบ่ง data pipeline ออกเป็นโน้ตบุ๊กสามไฟล์ ได้แก่ task1_ingest ที่ทำความสะอาดไฟล์ CSV ดิบและเขียนเป็น Delta table, task2_revenue ที่รวมยอดรายได้ตามประเทศ และ task3_top_customers ที่จัดอันดับลูกค้าตามยอดใช้จ่าย โน้ตบุ๊กทั้งสามถูกโหลดไว้ในโฟลเดอร์ Exercises แล้ว
งานของคุณคือเชื่อมโน้ตบุ๊กเหล่านี้เข้าด้วยกันเป็น Databricks Job รัน pipeline และแก้ไขข้อผิดพลาดที่เกิดขึ้น
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
การแปลงข้อมูลด้วย Spark SQL ใน Databricks
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด