Comece agoraComece grátis

Etapa 2: Identificar as fontes de texto

Neste exercício rápido, você vai carregar e examinar um pequeno corpus de avaliações de aluguel de imóveis na região de Boston. Você provavelmente já conhece read.csv(), que permite carregar um arquivo separado por vírgulas (CSV). Isso pode parecer trivial, mas o objetivo deste capítulo é fazer você percorrer todo o fluxo de trabalho do início ao fim, então vamos começar pela ingestão de dados!

Em seguida, basta aplicar str() para revisar a estrutura do data frame. É uma função prática para exibir de forma compacta valores iniciais e tipos de classe dos vetores.

Por fim, você vai aplicar dim() para imprimir as dimensões do data frame. Para um data frame, o console mostra o número de linhas e o número de colunas.

Outras funções como head(), tail() ou summary() são frequentemente usadas para explorar dados, mas neste caso vamos manter a inspeção breve para você chegar logo à parte divertida: a análise de sentimento!

Este exercicio faz parte do curso

Análise de Sentimentos em R

Ver curso

Instruções do exercicio

As avaliações de aluguel de imóveis em Boston estão em um arquivo CSV localizado pela variável predefinida bos_reviews_file.

  • Carregue as avaliações a partir de bos_reviews_file com read.csv(). Dê o nome bos_reviews ao objeto.
  • Examine a estrutura do data frame usando a função base str() aplicada a bos_reviews.
  • Descubra com quantas avaliações você vai trabalhar chamando dim() em bos_reviews.

exercicio interativo prático

Tente este exercicio completando este código de exemplo.

# bos_reviews_file has been pre-defined
bos_reviews_file

# load raw text
bos_reviews <- ___

# Structure
___

# Dimensions
___
Editar e Executar Código