Extrahera omnämnanden
I varje underlista i tweet-datamängden finns ett element som heter "mentions_screen_name" (dvs. Twitter-handles). Det här elementet innehåller antingen NULL om tweeten inte omnämnde någon, eller ett eller flera användarnamn som nämns i tweeten. Ett sätt att identifiera populära konton från en samling tweets är att ta reda på vilka användare som omnämns flest gånger.
Vi börjar med att extrahera en vektor med alla omnämnanden, och när vi har den vektorn räknar vi hur många gånger varje profil omnämns. För att göra det bygger vi en ny sammansatt funktion genom att kombinera table() (som räknar antalet förekomster av varje element i vektorn), sort() och tail().
purrr har redan laddats, och rstudioconf finns tillgänglig i din datamängd.
Den här övningen är en del av kursen
Funktionell programmering på mellannivå med purrr
Övningsinstruktioner
Bygg en funktion som är en kombination av
as_vector(),compact()ochflatten().Skapa en funktion som tar två argument:
listochwhat. Den här funktionen körmap( list, what )och skickar resultatet vidare tillflatten_to_vector.Skapa
six_most, en funktion som kombinerartail(),sort()ochtable().Kör
extractor()pårstudioconfoch skicka resultatet tillsix_most().
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Combine as_vector(), compact(), and flatten()
flatten_to_vector <- ___(___, ___, ___)
# Complete the function
extractor <- function(list, what = "mentions_screen_name"){
map( ___ , ___ ) %>%
___()
}
# Create six_most, with tail(), sort(), and table()
six_most <- ___(___, ___, ___)
# Run extractor() on rstudioconf
___(rstudioconf) %>%
___()