Comece agoraComece grátis

Iterações seguras

Como no capítulo anterior, vamos supor que você é uma pessoa analista de dados trabalhando em uma agência web. Desta vez, pediram que você fizesse algum web scraping.

(Observação: não se preocupe se você não souber fazer web scraping; vamos começar pelo básico, e todas as funções serão explicadas.)

Você recebeu uma lista de URLs, mas suspeita que algumas não são endereços reais. A primeira coisa a fazer é testar se você consegue se conectar a essas URLs. Para isso, vamos usar uma função simples do pacote readr: read_lines(), que vamos colocar dentro de um safely(). Quando recebe uma URL, read_lines() lê o HTML ou retorna um erro se a URL não estiver acessível.

O vetor urls está disponível no seu ambiente. Imprima-o no console se quiser ver o que há dentro.

Este exercicio faz parte do curso

Programação Funcional Intermediária com purrr

Ver curso

Instruções do exercicio

  • Crie uma versão segura da função read_lines().

  • Aplique essa nova função ao vetor fornecido chamado urls usando map.

  • Defina os nomes dos resultados com a função set_names().

  • Extraia o elemento "error" de cada sublista.

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

# Create a safe version of read_lines()
safe_read <- ___(___)

# Map it on the urls vector
res <- ___(urls, ___)

# Set the name of the results to `urls`
named_res <- ___(res, ___)

# Extract only the "error" part of each sublist
___(named_res, ___)
Editar e Executar Código