EmpezarEmpieza gratis

Resultados del mapa_futuro de vinculación por filas

Trabajas para una consultoría de estudios superiores que recomienda universidades de US a candidatos en el extranjero. Has obtenido un conjunto de datos de clasificación universitaria que contiene una columna score para investigación, citas, etc., de distintas universidades.

El estadístico del equipo ha escrito una función, calc_quants(), que está a tu disposición. Esta función calcula un rango para las puntuaciones de una universidad determinada. Toma dos argumentos, 1) un marco de datos con la columna score, y 2) los valores cuantílicos de interés q_values. Los cuantiles de interés están a tu disposición en la variable my_q_values.

my_q_values <- c(0.025, 0.975)

Se te pide que apliques esta función a los datos de cada universidad en paralelo.

furrr y tidyverse se han cargado para ti.

Este ejercicio forma parte del curso

Programación paralela en R

Ver curso

Instrucciones del ejercicio

  • Crea una configuración que especifique my_q_values como variable global requerida por todos los trabajadores.
  • Divide el marco de datos uni_data en university_name.
  • Aplica calc_quants() a las puntuaciones de cada universidad utilizando la variante future_map() correcta para vincular los resultados por filas.
  • Especifica los valores de q_values y la configuración de .options.

ejercicio interactivo práctico

Prueba este ejercicio completando este código de ejemplo.

plan(cluster, workers = 6)

# Create a configuration object to export global variables
config <- ___(___ = ___)

uni_data %>%
  # Split the data frame
  ___(___) %>% 
  # Specify the future_map variant and the function to map
  ___(___,
  # Specify values for the q_values argument and configuration for .options
                 q_values = ___,
                 .options = ___,
                 .id = "university")
plan(sequential)
Editar y ejecutar código