Ôn tập về tính bất biến
Bạn vừa thấy rằng tính bất biến và xử lý lười (lazy) là những khái niệm nền tảng trong cách Spark xử lý dữ liệu. Nhưng vì sao Spark lại dùng các data frame bất biến ngay từ đầu?
Bài tập này là một phần của khóa học
Làm sạch dữ liệu với PySpark
Bài tập tương tác thực hành
Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi
Bắt đầu bài tập