Datos tidy y wide en tidycensus
De forma predeterminada, las funciones de tidycensus devuelven data frames ordenados (tidy), en los que cada fila representa una combinación única de unidad y variable. Sin embargo, a veces es útil tener cada variable del Censo en su propia columna para ciertos métodos de visualización y análisis. Para lograrlo, puedes establecer output = "wide" en tus llamadas a get_acs() o get_decennial(), lo que colocará las estimaciones/valores y los márgenes de error en sus propias columnas.
Este ejercicio forma parte del curso
Análisis de datos del censo de EE. UU. en R
Instrucciones del ejercicio
- Obtén datos de la ACS sobre la renta mediana por hogar y la edad mediana para los condados de Oregón en formato wide especificando
output = "wide". - Revisa las primeras filas de tu data frame en formato wide.
- Crea un diagrama de dispersión de la renta mediana por hogar y la edad mediana con la función
plot().
ejercicio interactivo práctico
Prueba este ejercicio completando este código de ejemplo.
# Return county data in wide format
or_wide <- get_acs(geography = ___,
___ = "OR",
variables = c(hhincome = "B19013_001",
medage = "B01002_001"),
output = ___)
# Compare output to the tidy format from previous exercises
head(___)
# Create a scatterplot
___(or_wide$hhincomeE, or_wide$medageE)