Bắt đầu ngayBắt đầu miễn phí

Các bước của data pipeline

Với vai trò Kỹ sư Dữ liệu trưởng tại Sierra Publishing, bạn và nhóm Kỹ sư Dữ liệu của mình được giao nhiệm vụ làm sạch dữ liệu đánh giá sách thành một bộ dữ liệu sẵn sàng cho phân tích dành cho các nhà phân tích và data scientist.

Vì bạn nhận dữ liệu hằng ngày từ nhiều đối tác xuất bản, bạn cần tạo một data pipeline tự động và đáng tin cậy cho các bên sử dụng dữ liệu ở hạ nguồn.

Bài tập này là một phần của khóa học

Các khái niệm về Databricks

Xem khóa học

Bài tập tương tác thực hành

Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi

Bắt đầu bài tập