Kom igångKom igång gratis

Vi har en vinnare!

I den här övningen identifierar vi ett viktigt mått – vilken användare har publicerat tweeten med flest retweets?

Den här typen av information är viktig vid analys av sociala medier: den ger dig uppgifter om den mest "kända" tweeten i din datamängd. Det kan i sin tur hjälpa dig att fastställa vilka nyckelämnen och nyckelanvändare som finns kopplade till ett visst tema eller en viss hashtag.

Vi använder purrr för att extrahera den mest retweetade tweeten från vårt korpus och ta reda på vem som ligger bakom den. Eftersom vi vill att analysen ska köras enbart på originaltweets har vi förberett listan non_rt, som skapades i en tidigare övning.

Den här övningen är en del av kursen

Funktionell programmering på mellannivå med purrr

Visa kurs

Övningsinstruktioner

  • Extrahera alla "retweet_count"-element med lämplig variant av map_*(). Skicka resultatet till max().

  • Förifyll en map_at() där .at är "retweet_count" och .f är en mapper som testar likheten med max_rt.

  • Kör den här nya funktionen på non_rt, behåll enbart "retweet_count" och platta ut resultatet.

  • Skriv ut $screen_name och $text för resultatet till konsolen.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Get the max() of "retweet_count" 
max_rt <- ___(non_rt, ___) %>% 
  ___()

# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )

res <- non_rt %>%
  # Call max_rt_calc() on each element
  ___(___) %>% 
  # Keep elements where retweet_count is non-zero
  ___("___") %>% 
  # Flatten it
  ___()

# Print the "screen_name" and "text" of the result
res$screen_name
res$text
Redigera och kör kod