Sắp xếp các hàng
Quay lại thời nhạc lưu trên CD, luôn có một bài toán muôn thuở: sắp xếp CD thế nào để dễ tìm nhất? Theo tên nghệ sĩ? Theo thời gian? Theo thể loại?
Hàm arrange() cho phép bạn sắp xếp lại các hàng của một tibble. Hàm nhận một tibble, sau đó là các tên cột không để trong dấu nháy. Ví dụ, để sắp xếp tăng dần theo giá trị của cột x, rồi (khi x bị trùng) sắp xếp giảm dần theo giá trị của y, bạn có thể viết như sau.
a_tibble %>%
arrange(x, desc(y))
Lưu ý cách dùng desc() để ép sắp xếp theo thứ tự giảm dần. Đồng thời, trong sparklyr, hàm order() vốn dùng để sắp xếp các hàng của data.frame sẽ không hoạt động.
Bài tập này là một phần của khóa học
Nhập môn Spark với sparklyr trong R
Hướng dẫn bài tập
Kết nối Spark đã được tạo sẵn dưới tên spark_conn. Một tibble gắn với siêu dữ liệu bản nhạc lưu trong Spark đã được định nghĩa trước là track_metadata_tbl.
- Chọn các trường
artist_name,release,title, vàyear. - Pipe kết quả này để lọc các bản nhạc trong thập niên 1960.
- Pipe tiếp kết quả này vào
arrange()để sắp xếp theoartist_name, sau đóyeargiảm dần, rồititle.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# track_metadata_tbl has been pre-defined
track_metadata_tbl
# Manipulate the track metadata
track_metadata_tbl %>%
# Select columns
___ %>%
# Filter rows
___ %>%
# Arrange rows
___