Các bước của data pipeline
Với vai trò Kỹ sư Dữ liệu trưởng tại Sierra Publishing, bạn và nhóm Kỹ sư Dữ liệu của mình được giao nhiệm vụ làm sạch dữ liệu đánh giá sách thành một bộ dữ liệu sẵn sàng cho phân tích dành cho các nhà phân tích và data scientist.
Vì bạn nhận dữ liệu hằng ngày từ nhiều đối tác xuất bản, bạn cần tạo một data pipeline tự động và đáng tin cậy cho các bên sử dụng dữ liệu ở hạ nguồn.
Bài tập này là một phần của khóa học
Các khái niệm về Databricks
Bài tập tương tác thực hành
Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi
Bắt đầu bài tập