Simulace dat pomocí purrr
Když se snažíš vyřešit problém s daty, často nejdřív potřebuješ sestavit simulovaná data, abys ověřil/a, jestli je tvůj nápad vůbec realizovatelný. Například můžeš chtít testovat modely na datech se známými rozdíly, a zjistit tak, jestli modely fungují správně.
V tomto cvičení uvidíš, jak to funguje v purrr – budeme simulovat data pro dvě populace, a a b, z lokalit: "north", "east" a "west". Obě populace budou náhodně vygenerovány z normálního rozdělení s různými střední hodnotami a směrodatnými odchylkami.
Toto cvičení je součástí kurzu
Foundations of Functional Programming with purrr
Pokyny k cvičení
- Vytvoř seznam názvů lokalit: "north", "east" a "west".
- Pak pomocí
map()vytvoř seznam datových rámců se třemi sloupci, přičemž první sloupec jesites.- Druhý sloupec je populace
asmeanrovným 5, velikostí vzorkun200 asd(5/2). - Třetí sloupec je populace
bsmeanrovným 200, velikostí vzorkun200 asd15.
- Druhý sloupec je populace
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# List of sites north, east, and west
sites <- list(___)
# Create a list of data frames, each with a years, a, and b column
list_of_df <- map(___,
~___(___ = .x,
a = rnorm(mean = ___, n = ___, sd = ___),
b = rnorm(mean = ___, n = ___, sd = ___)))
list_of_df