Объединение результатов future_map по строкам
Вы работаете в консультационной компании, которая помогает иностранным абитуриентам выбирать университеты в США. В вашем распоряжении есть набор данных с рейтингом университетов, содержащий столбец score с оценками по различным показателям — исследовательской деятельности, цитируемости и другим.
Статистик команды написал функцию calc_quants(), которая уже доступна вам. Она вычисляет диапазон значений оценок для заданного университета и принимает два аргумента: 1) таблицу данных со столбцом score и 2) интересующие квантильные значения q_values. Квантильные значения доступны вам в переменной my_q_values.
my_q_values <- c(0.025, 0.975)
Вам необходимо применить эту функцию к данным по каждому университету в параллельном режиме.
Библиотеки furrr и tidyverse уже загружены.
Это упражнение является частью курса
Параллельное программирование на R
Инструкции к упражнению
- Создайте конфигурацию, в которой
my_q_valuesуказана как глобальная переменная, доступная всем рабочим процессам. - Разбейте таблицу данных
uni_dataпо столбцуuniversity_name. - Примените
calc_quants()к данным каждого университета, используя подходящий вариантfuture_map()для объединения результатов по строкам. - Укажите значения для
q_valuesи конфигурацию для.options.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
plan(cluster, workers = 6)
# Create a configuration object to export global variables
config <- ___(___ = ___)
uni_data %>%
# Split the data frame
___(___) %>%
# Specify the future_map variant and the function to map
___(___,
# Specify values for the q_values argument and configuration for .options
q_values = ___,
.options = ___,
.id = "university")
plan(sequential)