Xây dựng pipeline job nhiều tác vụ
Nhóm của bạn tại Global Retail Analytics đã tách pipeline dữ liệu thành ba notebook: task1_ingest làm sạch CSV thô và ghi ra một bảng Delta, task2_revenue tổng hợp doanh thu theo quốc gia, và task3_top_customers xếp hạng khách hàng theo mức chi tiêu. Cả ba đã được tải sẵn trong thư mục Exercises.
Nhiệm vụ của bạn là kết nối chúng thành một Databricks Job, chạy pipeline và sửa mọi lỗi phát sinh.
Bài tập này là một phần của khóa học
Chuyển đổi dữ liệu với Spark SQL trong Databricks
Bài tập tương tác thực hành
Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi
Bắt đầu bài tập