Імітація даних з Purrr
Часто, коли ми намагаємося розв'язати задачу з даними, спочатку потрібно згенерувати змодельовані дані, щоб перевірити, чи взагалі наша ідея здійсненна. Наприклад, ви можете хотіти протестувати моделі на даних із наперед відомими відмінностями, щоб переконатися, що моделі працюють коректно.
У цій вправі ви побачите, як це робиться в purrr, змоделювавши дані для двох популяцій, a і b, для сайтів: "north", "east" і "west". Обидві популяції випадково вибираються з нормального розподілу, але з різними середніми та стандартними відхиленнями.
Ця вправа є частиною курсу
Основи функціонального програмування з purrr
Інструкції до вправи
- Створіть список назв сайтів: "north", "east" і "west".
- Потім використайте
map(), щоб створити список датафреймів із трьома стовпцями: перший стовпець —sites.- Другий — популяція
a, у якоїmeanдорівнює 5, обсяг вибіркиn— 200, аsd— (5/2). - Третій — популяція
b, у якоїmeanдорівнює 200, обсяг вибіркиn— 200, аsd— 15.
- Другий — популяція
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# List of sites north, east, and west
sites <- list(___)
# Create a list of data frames, each with a years, a, and b column
list_of_df <- map(___,
~___(___ = .x,
a = rnorm(mean = ___, n = ___, sd = ___),
b = rnorm(mean = ___, n = ___, sd = ___)))
list_of_df