Симуляция данных с помощью Purrr
Когда нужно решить задачу с данными, часто приходится сначала сгенерировать смоделированные данные — чтобы проверить, реализуема ли идея в принципе. Например, можно протестировать модели на данных с известными различиями и убедиться, что они работают корректно.
В этом упражнении вы увидите, как это делается в purrr: вы смоделируете данные для двух популяций, a и b, из точек наблюдения: "north", "east" и "west". Обе популяции будут случайно взяты из нормального распределения с разными средними значениями и стандартными отклонениями.
Это упражнение является частью курса
Основы функционального программирования с purrr
Инструкции к упражнению
- Создайте список названий точек наблюдения: "north", "east" и "west".
- Затем используйте
map(), чтобы создать список фреймов данных с тремя столбцами; первый столбец —sites.- Второй — популяция
aсо средним значениемmeanравным 5, размером выборкиnравным 200 и стандартным отклонениемsdравным (5/2). - Третий — популяция
bсо средним значениемmeanравным 200, размером выборкиnравным 200 и стандартным отклонениемsdравным 15.
- Второй — популяция
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# List of sites north, east, and west
sites <- list(___)
# Create a list of data frames, each with a years, a, and b column
list_of_df <- map(___,
~___(___ = .x,
a = rnorm(mean = ___, n = ___, sd = ___),
b = rnorm(mean = ___, n = ___, sd = ___)))
list_of_df