Paso 2: Identifica las fuentes de texto
En este ejercicio corto vas a cargar y examinar un pequeño corpus de reseñas de alquileres por la zona de Boston. Esperamos que ya conozcas read.csv(), que te permite cargar un archivo CSV. Puede parecer básico, pero el objetivo de este capítulo es que recorras un flujo de trabajo completo de principio a fin, ¡así que empecemos por la ingesta de datos!
Después, aplica str() para revisar la estructura (str) del data frame. Es una función muy práctica para mostrar de forma compacta valores iniciales y tipos de clase de los vectores.
Por último, aplica dim() para imprimir las dimensiones (dim) del data frame. En un data frame, la consola mostrará el número de filas y el número de columnas.
Otras funciones como head(), tail() o summary se usan a menudo para explorar datos, pero en este caso mantenemos la revisión breve para que pases rápido al análisis de sentimiento, ¡que es la parte interesante!
Este ejercicio forma parte del curso
Análisis de sentimiento en R
Instrucciones del ejercicio
Las reseñas de alquileres en Boston están guardadas en un archivo CSV localizado por la variable predefinida bos_reviews_file.
- Carga las reseñas desde
bos_reviews_fileconread.csv(). Llama al objetobos_reviews. - Examina la estructura del data frame usando la función base
str()aplicada abos_reviews. - Averigua cuántas reseñas vas a manejar llamando a
dim()sobrebos_reviews.
ejercicio interactivo práctico
Prueba este ejercicio completando este código de ejemplo.
# bos_reviews_file has been pre-defined
bos_reviews_file
# load raw text
bos_reviews <- ___
# Structure
___
# Dimensions
___