EmpezarEmpieza gratis

Paso 2: Identifica las fuentes de texto

En este ejercicio corto vas a cargar y examinar un pequeño corpus de reseñas de alquileres por la zona de Boston. Esperamos que ya conozcas read.csv(), que te permite cargar un archivo CSV. Puede parecer básico, pero el objetivo de este capítulo es que recorras un flujo de trabajo completo de principio a fin, ¡así que empecemos por la ingesta de datos!

Después, aplica str() para revisar la estructura (str) del data frame. Es una función muy práctica para mostrar de forma compacta valores iniciales y tipos de clase de los vectores.

Por último, aplica dim() para imprimir las dimensiones (dim) del data frame. En un data frame, la consola mostrará el número de filas y el número de columnas.

Otras funciones como head(), tail() o summary se usan a menudo para explorar datos, pero en este caso mantenemos la revisión breve para que pases rápido al análisis de sentimiento, ¡que es la parte interesante!

Este ejercicio forma parte del curso

Análisis de sentimiento en R

Ver curso

Instrucciones del ejercicio

Las reseñas de alquileres en Boston están guardadas en un archivo CSV localizado por la variable predefinida bos_reviews_file.

  • Carga las reseñas desde bos_reviews_file con read.csv(). Llama al objeto bos_reviews.
  • Examina la estructura del data frame usando la función base str() aplicada a bos_reviews.
  • Averigua cuántas reseñas vas a manejar llamando a dim() sobre bos_reviews.

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

# bos_reviews_file has been pre-defined
bos_reviews_file

# load raw text
bos_reviews <- ___

# Structure
___

# Dimensions
___
Editar y ejecutar código