Chúng ta đã tìm ra người dẫn đầu!
Trong bài tập này, chúng ta sẽ xác định một chỉ số quan trọng — ai là người dùng đã đăng tweet có số lần retweet nhiều nhất?
Thông tin kiểu này rất quan trọng khi bạn phân tích mạng xã hội: nó cho bạn biết tweet "nổi tiếng" nhất trong bộ dữ liệu. Điều này có thể giúp bạn, trong tương lai, xác định các chủ đề và tài khoản chủ chốt cho một chủ đề/hashtag cụ thể.
Chúng ta sẽ dùng purrr để trích xuất tweet được retweet nhiều nhất từ tập dữ liệu, và xem người dùng đứng sau tweet này là ai. Vì bạn chỉ muốn phân tích các tweet gốc, chúng tôi đã cung cấp list non_rt, được tạo ở một bài tập trước.
Bài tập này là một phần của khóa học
Lập trình hàm nâng cao với purrr
Hướng dẫn bài tập
Trích xuất tất cả phần tử
"retweet_count"bằng biến thểmap_*()phù hợp. Truyền kết quả vàomax().Khởi tạo sẵn một
map_at(), với.atlà"retweet_count"và.flà một mapper kiểm tra điều kiện bằng vớimax_rt.Map hàm mới này lên
non_rt, chỉ giữ"retweet_count", rồi làm phẳng kết quả.In
$screen_namevà$textcủa kết quả ra console.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text