Bắt đầu ngayBắt đầu miễn phí

Sắp xếp các hàng

Quay lại thời nhạc lưu trên CD, luôn có một bài toán muôn thuở: sắp xếp CD thế nào để dễ tìm nhất? Theo tên nghệ sĩ? Theo thời gian? Theo thể loại?

Hàm arrange() cho phép bạn sắp xếp lại các hàng của một tibble. Hàm nhận một tibble, sau đó là các tên cột không để trong dấu nháy. Ví dụ, để sắp xếp tăng dần theo giá trị của cột x, rồi (khi x bị trùng) sắp xếp giảm dần theo giá trị của y, bạn có thể viết như sau.

a_tibble %>%
  arrange(x, desc(y))

Lưu ý cách dùng desc() để ép sắp xếp theo thứ tự giảm dần. Đồng thời, trong sparklyr, hàm order() vốn dùng để sắp xếp các hàng của data.frame sẽ không hoạt động.

Bài tập này là một phần của khóa học

Nhập môn Spark với sparklyr trong R

Xem khóa học

Hướng dẫn bài tập

Kết nối Spark đã được tạo sẵn dưới tên spark_conn. Một tibble gắn với siêu dữ liệu bản nhạc lưu trong Spark đã được định nghĩa trước là track_metadata_tbl.

  • Chọn các trường artist_name, release, title, và year.
  • Pipe kết quả này để lọc các bản nhạc trong thập niên 1960.
  • Pipe tiếp kết quả này vào arrange() để sắp xếp theo artist_name, sau đó year giảm dần, rồi title.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# track_metadata_tbl has been pre-defined
track_metadata_tbl

# Manipulate the track metadata
track_metadata_tbl %>%
  # Select columns
  ___ %>%
  # Filter rows
  ___ %>%
  # Arrange rows
  ___
Chỉnh sửa và Chạy Mã