Práce s URL adresami
V předchozím cvičení jsme z dat extrahovali surový počet tweetů obsahujících vzor "github". Zatím jde jen o holé číslo: 347, a stále nevíš, jaký podíl z celkového počtu URL adres tato hodnota představuje.
V tomto cvičení vytvoříme funkci str_prop_detected(), která přijme znakový vektor a vzor a vrátí podíl prvků, jež tento vzor obsahují. Tuto funkci lze použít i na jiných datasetech k zjištění podílu shod vzoru ve znakovém vektoru.
Skombinujeme zde některé funkce z purrr s funkcí str_detect() z balíčku stringr. Oba balíčky jsou už načteny a dataset rstudioconf je stále dostupný v tvém pracovním prostoru.
Toto cvičení je součástí kurzu
Intermediate Functional Programming with purrr
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Complete the function definition
str_prop_detected <- function(string, pattern) {
string %>%
# Detect the pattern
___(___) %>%
# Calculate the mean
___()
}
# Create flatten_and_compact()
flatten_and_compact <- ___(___, ___)