Säkra iterationer
Precis som i föregående kapitel, låt oss anta att du är en dataanalytiker som arbetar på en webbyrå. Den här gången har du fått i uppgift att göra lite webbskrapning.
(Obs: bli inte orolig om du inte vet hur webbskrapning fungerar – vi börjar enkelt och alla funktioner förklaras längs vägen).
Du har fått en lista med URL:er, men du misstänker att vissa inte är riktiga adresser. Det första du gör är att testa om du kan ansluta till dessa URL:er. För det använder vi en enkel funktion från paketet readr: read_lines(), som vi lägger in i en safely(). Om en URL är giltig läser read_lines() HTML-innehållet – annars returneras ett fel.
Vektorn urls finns tillgänglig i din arbetsmiljö. Skriv ut den i konsolen om du vill se vad den innehåller.
Den här övningen är en del av kursen
Funktionell programmering på mellannivå med purrr
Övningsinstruktioner
Skapa en säker version av funktionen
read_lines().Mappa den nyss skapade funktionen över den angivna vektorn
urls.Sätt namn på resultaten med funktionen
set_names().Extrahera elementet
"error"från varje dellista.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Create a safe version of read_lines()
safe_read <- ___(___)
# Map it on the urls vector
res <- ___(urls, ___)
# Set the name of the results to `urls`
named_res <- ___(res, ___)
# Extract only the "error" part of each sublist
___(named_res, ___)