Bắt đầu ngayBắt đầu miễn phí

Chúng ta đã tìm ra người dẫn đầu!

Trong bài tập này, chúng ta sẽ xác định một chỉ số quan trọng — ai là người dùng đã đăng tweet có số lần retweet nhiều nhất?

Thông tin kiểu này rất quan trọng khi bạn phân tích mạng xã hội: nó cho bạn biết tweet "nổi tiếng" nhất trong bộ dữ liệu. Điều này có thể giúp bạn, trong tương lai, xác định các chủ đề và tài khoản chủ chốt cho một chủ đề/hashtag cụ thể.

Chúng ta sẽ dùng purrr để trích xuất tweet được retweet nhiều nhất từ tập dữ liệu, và xem người dùng đứng sau tweet này là ai. Vì bạn chỉ muốn phân tích các tweet gốc, chúng tôi đã cung cấp list non_rt, được tạo ở một bài tập trước.

Bài tập này là một phần của khóa học

Lập trình hàm nâng cao với purrr

Xem khóa học

Hướng dẫn bài tập

  • Trích xuất tất cả phần tử "retweet_count" bằng biến thể map_*() phù hợp. Truyền kết quả vào max().

  • Khởi tạo sẵn một map_at(), với .at"retweet_count".f là một mapper kiểm tra điều kiện bằng với max_rt.

  • Map hàm mới này lên non_rt, chỉ giữ "retweet_count", rồi làm phẳng kết quả.

  • In $screen_name$text của kết quả ra console.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Get the max() of "retweet_count" 
max_rt <- ___(non_rt, ___) %>% 
  ___()

# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )

res <- non_rt %>%
  # Call max_rt_calc() on each element
  ___(___) %>% 
  # Keep elements where retweet_count is non-zero
  ___("___") %>% 
  # Flatten it
  ___()

# Print the "screen_name" and "text" of the result
res$screen_name
res$text
Chỉnh sửa và Chạy Mã