Examinar el número de niveles
dplyr tiene otras dos funciones muy útiles para explorar un conjunto de datos. La primera es slice_max(var, n = x), que nos devuelve las primeras x filas de un conjunto de datos según el valor de var. La otra es pull(), que nos permite extraer una columna y quitarle el nombre, dejando solo los valores de esa columna.
Por ejemplo, si quisiéramos obtener, como un conjunto de valores, los dos valores más altos de mpg del clásico conjunto mtcars, escribiríamos:
mtcars %>%
slice_max(mpg, n = 2) %>%
pull(mpg)
Esto nos devuelve:
[1] 32.4 33.9
Este ejercicio forma parte del curso
Datos categóricos en el Tidyverse
Instrucciones del ejercicio
- Usa
slice_max()para imprimir las 3 filas con el mayor número de niveles de factor. - Filtrando la variable
CurrentJobTitleSelect, usapullpara obtener cuántos niveles tiene.
ejercicio interactivo práctico
Prueba este ejercicio completando este código de ejemplo.
# Select the 3 rows with the highest number of levels
number_of_levels %>%
___(num_levels, n = 3)
number_of_levels %>%
# Filter for where the column called variable equals CurrentJobTitleSelect
filter(___) %>%
# Pull num_levels
___