ПочатиПочніть безкоштовно

Імітація даних з Purrr

Часто, коли ми намагаємося розв'язати задачу з даними, спочатку потрібно згенерувати змодельовані дані, щоб перевірити, чи взагалі наша ідея здійсненна. Наприклад, ви можете хотіти протестувати моделі на даних із наперед відомими відмінностями, щоб переконатися, що моделі працюють коректно.

У цій вправі ви побачите, як це робиться в purrr, змоделювавши дані для двох популяцій, a і b, для сайтів: "north", "east" і "west". Обидві популяції випадково вибираються з нормального розподілу, але з різними середніми та стандартними відхиленнями.

Ця вправа є частиною курсу

Основи функціонального програмування з purrr

Переглянути курс

Інструкції до вправи

  • Створіть список назв сайтів: "north", "east" і "west".
  • Потім використайте map(), щоб створити список датафреймів із трьома стовпцями: перший стовпець — sites.
    • Другий — популяція a, у якої mean дорівнює 5, обсяг вибірки n — 200, а sd — (5/2).
    • Третій — популяція b, у якої mean дорівнює 200, обсяг вибірки n — 200, а sd — 15.

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

# List of sites north, east, and west
sites <- list(___)

# Create a list of data frames, each with a years, a, and b column
list_of_df <-  map(___,  
  ~___(___ = .x,
       a = rnorm(mean = ___, n = ___, sd = ___),
       b = rnorm(mean = ___, n = ___, sd = ___)))

list_of_df
Редагувати та запускати код