Začněte nyníZačněte zdarma

Máme vítěze!

V tomto cvičení identifikujeme důležitou metriku — který uživatel zveřejnil tweet s nejvíce retweety?

Takový typ informace je při analýze sociálních médií klíčový: řekne ti, který tweet je v tvém datasetu nejslavnější. To může v budoucnu pomoct určit hlavní témata a klíčové uživatele pro konkrétní téma nebo hashtag.

Pomocí purrr extrahujeme nejvíce retweetovaný tweet z našeho korpusu a zjistíme, kdo za ním stojí. Protože chceme analýzu provést pouze na původních tweetech, máš k dispozici seznam non_rt, který byl vytvořen v předchozím cvičení.

Toto cvičení je součástí kurzu

Intermediate Functional Programming with purrr

Zobrazit kurz

Pokyny k cvičení

  • Extrahuj všechny elementy "retweet_count" pomocí vhodné varianty map_*(). Výsledek předej funkci max().

  • Předvyplň map_at() tak, aby .at bylo "retweet_count" a .f byl mapper testující rovnost s max_rt.

  • Tuto novou funkci aplikuj na non_rt, ponech pouze "retweet_count" a výsledek zploštěl.

  • Vypiš do konzole $screen_name a $text výsledku.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Get the max() of "retweet_count" 
max_rt <- ___(non_rt, ___) %>% 
  ___()

# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )

res <- non_rt %>%
  # Call max_rt_calc() on each element
  ___(___) %>% 
  # Keep elements where retweet_count is non-zero
  ___("___") %>% 
  # Flatten it
  ___()

# Print the "screen_name" and "text" of the result
res$screen_name
res$text
Upravit a spustit kód