ÎncepețiÎncepe gratuit

Avem un câștigător!

În acest exercițiu, vom identifica o metrică importantă — care este utilizatorul care a publicat tweet-ul cu cele mai multe retweet-uri?

Acest tip de informație este esențial în analiza rețelelor sociale: îți oferă date despre cel mai „faimos" tweet din setul tău de date. Astfel, în viitor, poți stabili care sunt temele și utilizatorii-cheie pentru un anumit subiect/hashtag.

Vom folosi purrr pentru a extrage tweet-ul cu cele mai multe retweet-uri din corpusul nostru și pentru a afla cine se află în spatele acestuia. Deoarece dorim ca analiza să fie realizată doar pe tweet-uri originale, am pus la dispoziție lista non_rt, creată într-un exercițiu anterior.

Acest exercițiu face parte din cursul

Programare funcțională intermediară cu purrr

Vezi cursul

Instrucțiuni pentru exercițiu

  • Extrage toate elementele "retweet_count" cu varianta potrivită map_*(). Transmite rezultatul funcției max().

  • Completează un apel map_at(), cu .at setat la "retweet_count" și .f fiind un mapper care verifică egalitatea cu max_rt.

  • Aplică această nouă funcție pe non_rt, păstrează doar elementele "retweet_count" și aplatizează rezultatul.

  • Afișează în consolă $screen_name și $text ale rezultatului.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Get the max() of "retweet_count" 
max_rt <- ___(non_rt, ___) %>% 
  ___()

# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )

res <- non_rt %>%
  # Call max_rt_calc() on each element
  ___(___) %>% 
  # Keep elements where retweet_count is non-zero
  ___("___") %>% 
  # Flatten it
  ___()

# Print the "screen_name" and "text" of the result
res$screen_name
res$text
Editează și rulează codul