Začněte nyníZačněte zdarma

Bezpečné iterace

Stejně jako v předchozí kapitole si představ, že pracuješ jako datový analytik/analytička ve webové agentuře. Tentokrát dostaneš za úkol web scraping.

(Poznámka: neboj se, pokud web scraping neznáš – začneme jednoduše a všechny funkce budou vysvětleny.)

Dostaneš seznam URL adres, ale máš podezření, že některé z nich nejsou platné. Nejprve proto otestuješ, zda se k těmto adresám vůbec lze připojit. K tomu použijeme jednoduchou funkci z balíčku readr: read_lines(), kterou vložíme do safely(). Funkce read_lines() přijme URL adresu a načte její HTML obsah – nebo vrátí chybu, pokud adresa není dostupná.

Vektor urls je k dispozici v tvém pracovním prostředí. Pokud chceš vidět, co obsahuje, vypiš ho do konzole.

Toto cvičení je součástí kurzu

Intermediate Functional Programming with purrr

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř bezpečnou verzi funkce read_lines().

  • Namapuj tuto nově vytvořenou funkci na poskytnutý vektor urls.

  • Nastav názvy výsledků pomocí funkce set_names().

  • Extrahuj element "error" z každého podseznam.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Create a safe version of read_lines()
safe_read <- ___(___)

# Map it on the urls vector
res <- ___(urls, ___)

# Set the name of the results to `urls`
named_res <- ___(res, ___)

# Extract only the "error" part of each sublist
___(named_res, ___)
Upravit a spustit kód