Wir haben eine:n Gewinner:in!
In dieser Übung ermitteln wir eine wichtige Kennzahl — wer ist der:die Nutzer:in, der:die den Tweet mit den meisten Retweets veröffentlicht hat?
Solche Informationen sind wichtig, wenn du Social-Media-Analysen durchführst: Sie verraten dir, welcher Tweet in deinem Datensatz am „bekanntesten“ ist. Das kann später helfen, die wichtigsten Themen und Nutzer:innen für ein bestimmtes Thema/Hashtag zu bestimmen.
Wir verwenden purrr, um den am häufigsten retweeteten Tweet aus unserem Korpus zu extrahieren und zu sehen, wer hinter diesem Tweet steckt. Da wir die Analyse nur auf Original-Tweets ausführen wollen, stellen wir dir die Liste non_rt zur Verfügung, die in einer vorherigen Übung erstellt wurde.
Diese Übung ist Teil des Kurses
<Kurs>Fortgeschrittene funktionale Programmierung mit purrr</Kurs>Übungsanweisungen
Extrahiere alle
"retweet_count"-Elemente mit der passendenmap_*()-Variante. Übergib das Ergebnis anmax().Fülle ein
map_at()vor, wobei.at"retweet_count"ist und.fein Mapper, der auf Gleichheit mitmax_rttestet.Wende diese neue Funktion auf
non_rtan, behalte nur"retweet_count"und flache das Ergebnis ab.Gib
$screen_nameund$textdes Ergebnisses in der Konsole aus.
Interaktive praktische Übung
Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.
# Get the max() of "retweet_count"
max_rt <- ___(non_rt, ___) %>%
___()
# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )
res <- non_rt %>%
# Call max_rt_calc() on each element
___(___) %>%
# Keep elements where retweet_count is non-zero
___("___") %>%
# Flatten it
___()
# Print the "screen_name" and "text" of the result
res$screen_name
res$text