Etapa 2: Identificar as fontes de texto
Neste exercício rápido, você vai carregar e examinar um pequeno corpus de avaliações de aluguel de imóveis na região de Boston. Você provavelmente já conhece read.csv(), que permite carregar um arquivo separado por vírgulas (CSV). Isso pode parecer trivial, mas o objetivo deste capítulo é fazer você percorrer todo o fluxo de trabalho do início ao fim, então vamos começar pela ingestão de dados!
Em seguida, basta aplicar str() para revisar a estrutura do data frame. É uma função prática para exibir de forma compacta valores iniciais e tipos de classe dos vetores.
Por fim, você vai aplicar dim() para imprimir as dimensões do data frame. Para um data frame, o console mostra o número de linhas e o número de colunas.
Outras funções como head(), tail() ou summary() são frequentemente usadas para explorar dados, mas neste caso vamos manter a inspeção breve para você chegar logo à parte divertida: a análise de sentimento!
Este exercicio faz parte do curso
Análise de Sentimentos em R
Instruções do exercicio
As avaliações de aluguel de imóveis em Boston estão em um arquivo CSV localizado pela variável predefinida bos_reviews_file.
- Carregue as avaliações a partir de
bos_reviews_filecomread.csv(). Dê o nomebos_reviewsao objeto. - Examine a estrutura do data frame usando a função base
str()aplicada abos_reviews. - Descubra com quantas avaliações você vai trabalhar chamando
dim()embos_reviews.
exercicio interativo prático
Tente este exercicio completando este código de exemplo.
# bos_reviews_file has been pre-defined
bos_reviews_file
# load raw text
bos_reviews <- ___
# Structure
___
# Dimensions
___