Bezpečné iterace
Stejně jako v předchozí kapitole si představ, že pracuješ jako datový analytik/analytička ve webové agentuře. Tentokrát dostaneš za úkol web scraping.
(Poznámka: neboj se, pokud web scraping neznáš – začneme jednoduše a všechny funkce budou vysvětleny.)
Dostaneš seznam URL adres, ale máš podezření, že některé z nich nejsou platné. Nejprve proto otestuješ, zda se k těmto adresám vůbec lze připojit. K tomu použijeme jednoduchou funkci z balíčku readr: read_lines(), kterou vložíme do safely(). Funkce read_lines() přijme URL adresu a načte její HTML obsah – nebo vrátí chybu, pokud adresa není dostupná.
Vektor urls je k dispozici v tvém pracovním prostředí. Pokud chceš vidět, co obsahuje, vypiš ho do konzole.
Toto cvičení je součástí kurzu
Intermediate Functional Programming with purrr
Pokyny k cvičení
Vytvoř bezpečnou verzi funkce
read_lines().Namapuj tuto nově vytvořenou funkci na poskytnutý vektor
urls.Nastav názvy výsledků pomocí funkce
set_names().Extrahuj element
"error"z každého podseznam.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Create a safe version of read_lines()
safe_read <- ___(___)
# Map it on the urls vector
res <- ___(urls, ___)
# Set the name of the results to `urls`
named_res <- ___(res, ___)
# Extract only the "error" part of each sublist
___(named_res, ___)