LoslegenKostenlos starten

Wir haben eine:n Gewinner:in!

In dieser Übung ermitteln wir eine wichtige Kennzahl — wer ist der:die Nutzer:in, der:die den Tweet mit den meisten Retweets veröffentlicht hat?

Solche Informationen sind wichtig, wenn du Social-Media-Analysen durchführst: Sie verraten dir, welcher Tweet in deinem Datensatz am „bekanntesten“ ist. Das kann später helfen, die wichtigsten Themen und Nutzer:innen für ein bestimmtes Thema/Hashtag zu bestimmen.

Wir verwenden purrr, um den am häufigsten retweeteten Tweet aus unserem Korpus zu extrahieren und zu sehen, wer hinter diesem Tweet steckt. Da wir die Analyse nur auf Original-Tweets ausführen wollen, stellen wir dir die Liste non_rt zur Verfügung, die in einer vorherigen Übung erstellt wurde.

Diese Übung ist Teil des Kurses

<Kurs>Fortgeschrittene funktionale Programmierung mit purrr</Kurs>
Kurs ansehen

Übungsanweisungen

  • Extrahiere alle "retweet_count"-Elemente mit der passenden map_*()-Variante. Übergib das Ergebnis an max().

  • Fülle ein map_at() vor, wobei .at "retweet_count" ist und .f ein Mapper, der auf Gleichheit mit max_rt testet.

  • Wende diese neue Funktion auf non_rt an, behalte nur "retweet_count" und flache das Ergebnis ab.

  • Gib $screen_name und $text des Ergebnisses in der Konsole aus.

Interaktive praktische Übung

Versuche dich an dieser Übung, indem du diesen Beispielcode vervollständigst.

# Get the max() of "retweet_count" 
max_rt <- ___(non_rt, ___) %>% 
  ___()

# Prefill map_at() with a mapper testing if .x equal max_rt
max_rt_calc <- ___(___, .at = "retweet_count", .f := ~ ___ )

res <- non_rt %>%
  # Call max_rt_calc() on each element
  ___(___) %>% 
  # Keep elements where retweet_count is non-zero
  ___("___") %>% 
  # Flatten it
  ___()

# Print the "screen_name" and "text" of the result
res$screen_name
res$text
Code bearbeiten und ausführen