EmpezarEmpieza gratis

Examinar el número de niveles

dplyr tiene otras dos funciones muy útiles para explorar un conjunto de datos. La primera es slice_max(var, n = x), que nos devuelve las primeras x filas de un conjunto de datos según el valor de var. La otra es pull(), que nos permite extraer una columna y quitarle el nombre, dejando solo los valores de esa columna.

Por ejemplo, si quisiéramos obtener, como un conjunto de valores, los dos valores más altos de mpg del clásico conjunto mtcars, escribiríamos:

mtcars %>%
  slice_max(mpg, n = 2) %>%
  pull(mpg)

Esto nos devuelve:

[1] 32.4 33.9

Este ejercicio forma parte del curso

Datos categóricos en el Tidyverse

Ver curso

Instrucciones del ejercicio

  • Usa slice_max() para imprimir las 3 filas con el mayor número de niveles de factor.
  • Filtrando la variable CurrentJobTitleSelect, usa pull para obtener cuántos niveles tiene.

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

# Select the 3 rows with the highest number of levels
number_of_levels %>%
    ___(num_levels, n = 3)
    
number_of_levels %>%
	# Filter for where the column called variable equals CurrentJobTitleSelect
    filter(___) %>%
	# Pull num_levels
    ___
Editar y ejecutar código