Bắt đầu ngayBắt đầu miễn phí

Tóm tắt dữ liệu

Giờ hãy tạo một biểu đồ phân mảnh (faceted) để so sánh mức độ hữu ích giữa các nền tảng học tập.

Trong bài này, bạn sẽ gặp một hàm mới của dplyr, add_count(). add_count() sẽ thêm một cột n vào dữ liệu, giữ nguyên số dòng như ban đầu. Tương tự count(), mặc định n là số dòng trong mỗi nhóm, nhưng bạn có thể thay đổi với đối số wt (weight). Khi đặt wt bằng một cột khác, n sẽ bằng tổng của cột đó theo từng nhóm.

Giả sử bạn muốn thêm vào iris một cột là tổng Petal.Length của tất cả các bông hoa cùng Species. Bạn sẽ viết:

iris %>%
   add_count(Species, wt = Petal.Length) %>%
   select(Species, Petal.Length, n)

Kết quả trả về sẽ là:

# A tibble: 150 x 3
   Species Petal.Length     n
   <fct>          <dbl> <dbl>
 1 setosa           1.4  73.1
 2 setosa           1.4  73.1
 3 virginica        6.4  278.

Bài tập này là một phần của khóa học

Dữ liệu phân loại trong Tidyverse

Xem khóa học

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

learning_platform_usefulness %>%
  # Change dataset to one row per learning_platform usefulness pair with number of entries for each
  ___(___, ___)
Chỉnh sửa và Chạy Mã