НачатьНачать бесплатно

Симуляция данных с помощью Purrr

Когда нужно решить задачу с данными, часто приходится сначала сгенерировать смоделированные данные — чтобы проверить, реализуема ли идея в принципе. Например, можно протестировать модели на данных с известными различиями и убедиться, что они работают корректно.

В этом упражнении вы увидите, как это делается в purrr: вы смоделируете данные для двух популяций, a и b, из точек наблюдения: "north", "east" и "west". Обе популяции будут случайно взяты из нормального распределения с разными средними значениями и стандартными отклонениями.

Это упражнение является частью курса

Основы функционального программирования с purrr

Посмотреть курс

Инструкции к упражнению

  • Создайте список названий точек наблюдения: "north", "east" и "west".
  • Затем используйте map(), чтобы создать список фреймов данных с тремя столбцами; первый столбец — sites.
    • Второй — популяция a со средним значением mean равным 5, размером выборки n равным 200 и стандартным отклонением sd равным (5/2).
    • Третий — популяция b со средним значением mean равным 200, размером выборки n равным 200 и стандартным отклонением sd равным 15.

Интерактивное практическое упражнение

Попробуйте выполнить это упражнение, дополнив этот пример кода.

# List of sites north, east, and west
sites <- list(___)

# Create a list of data frames, each with a years, a, and b column
list_of_df <-  map(___,  
  ~___(___ = .x,
       a = rnorm(mean = ___, n = ___, sd = ___),
       b = rnorm(mean = ___, n = ___, sd = ___)))

list_of_df
Редактировать и запускать код