EmpezarEmpieza gratis

Datos tidy y wide en tidycensus

De forma predeterminada, las funciones de tidycensus devuelven data frames ordenados (tidy), en los que cada fila representa una combinación única de unidad y variable. Sin embargo, a veces es útil tener cada variable del Censo en su propia columna para ciertos métodos de visualización y análisis. Para lograrlo, puedes establecer output = "wide" en tus llamadas a get_acs() o get_decennial(), lo que colocará las estimaciones/valores y los márgenes de error en sus propias columnas.

Este ejercicio forma parte del curso

Análisis de datos del censo de EE. UU. en R

Ver curso

Instrucciones del ejercicio

  • Obtén datos de la ACS sobre la renta mediana por hogar y la edad mediana para los condados de Oregón en formato wide especificando output = "wide".
  • Revisa las primeras filas de tu data frame en formato wide.
  • Crea un diagrama de dispersión de la renta mediana por hogar y la edad mediana con la función plot().

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

# Return county data in wide format
or_wide <- get_acs(geography = ___, 
                     ___ = "OR",
                     variables = c(hhincome = "B19013_001", 
                            medage = "B01002_001"), 
                     output = ___)

# Compare output to the tidy format from previous exercises
head(___)

# Create a scatterplot
___(or_wide$hhincomeE, or_wide$medageE)
Editar y ejecutar código