НачатьНачать бесплатно

Объединение результатов future_map по строкам

Вы работаете в консультационной компании, которая помогает иностранным абитуриентам выбирать университеты в США. В вашем распоряжении есть набор данных с рейтингом университетов, содержащий столбец score с оценками по различным показателям — исследовательской деятельности, цитируемости и другим.

Статистик команды написал функцию calc_quants(), которая уже доступна вам. Она вычисляет диапазон значений оценок для заданного университета и принимает два аргумента: 1) таблицу данных со столбцом score и 2) интересующие квантильные значения q_values. Квантильные значения доступны вам в переменной my_q_values.

my_q_values <- c(0.025, 0.975)

Вам необходимо применить эту функцию к данным по каждому университету в параллельном режиме.

Библиотеки furrr и tidyverse уже загружены.

Это упражнение является частью курса

Параллельное программирование на R

Посмотреть курс

Инструкции к упражнению

  • Создайте конфигурацию, в которой my_q_values указана как глобальная переменная, доступная всем рабочим процессам.
  • Разбейте таблицу данных uni_data по столбцу university_name.
  • Примените calc_quants() к данным каждого университета, используя подходящий вариант future_map() для объединения результатов по строкам.
  • Укажите значения для q_values и конфигурацию для .options.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

plan(cluster, workers = 6)

# Create a configuration object to export global variables
config <- ___(___ = ___)

uni_data %>%
  # Split the data frame
  ___(___) %>% 
  # Specify the future_map variant and the function to map
  ___(___,
  # Specify values for the q_values argument and configuration for .options
                 q_values = ___,
                 .options = ___,
                 .id = "university")
plan(sequential)
Редактировать и запускать код