Kom igångKom igång gratis

Extrahera omnämnanden

I varje underlista i tweet-datamängden finns ett element som heter "mentions_screen_name" (dvs. Twitter-handles). Det här elementet innehåller antingen NULL om tweeten inte omnämnde någon, eller ett eller flera användarnamn som nämns i tweeten. Ett sätt att identifiera populära konton från en samling tweets är att ta reda på vilka användare som omnämns flest gånger.

Vi börjar med att extrahera en vektor med alla omnämnanden, och när vi har den vektorn räknar vi hur många gånger varje profil omnämns. För att göra det bygger vi en ny sammansatt funktion genom att kombinera table() (som räknar antalet förekomster av varje element i vektorn), sort() och tail().

purrr har redan laddats, och rstudioconf finns tillgänglig i din datamängd.

Den här övningen är en del av kursen

Funktionell programmering på mellannivå med purrr

Visa kurs

Övningsinstruktioner

  • Bygg en funktion som är en kombination av as_vector(), compact() och flatten().

  • Skapa en funktion som tar två argument: list och what. Den här funktionen kör map( list, what ) och skickar resultatet vidare till flatten_to_vector.

  • Skapa six_most, en funktion som kombinerar tail(), sort() och table().

  • Kör extractor()rstudioconf och skicka resultatet till six_most().

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Combine as_vector(), compact(), and flatten()
flatten_to_vector <- ___(___, ___, ___)

# Complete the function
extractor <- function(list, what = "mentions_screen_name"){
  map( ___ , ___ ) %>%
    ___()
}

# Create six_most, with tail(), sort(), and table()
six_most <- ___(___, ___, ___)

# Run extractor() on rstudioconf
___(rstudioconf) %>% 
  ___()
Redigera och kör kod