Začněte nyníZačněte zdarma

Simulace dat pomocí purrr

Když se snažíš vyřešit problém s daty, často nejdřív potřebuješ sestavit simulovaná data, abys ověřil/a, jestli je tvůj nápad vůbec realizovatelný. Například můžeš chtít testovat modely na datech se známými rozdíly, a zjistit tak, jestli modely fungují správně.

V tomto cvičení uvidíš, jak to funguje v purrr – budeme simulovat data pro dvě populace, a a b, z lokalit: "north", "east" a "west". Obě populace budou náhodně vygenerovány z normálního rozdělení s různými střední hodnotami a směrodatnými odchylkami.

Toto cvičení je součástí kurzu

Foundations of Functional Programming with purrr

Zobrazit kurz

Pokyny k cvičení

  • Vytvoř seznam názvů lokalit: "north", "east" a "west".
  • Pak pomocí map() vytvoř seznam datových rámců se třemi sloupci, přičemž první sloupec je sites.
    • Druhý sloupec je populace a s mean rovným 5, velikostí vzorku n 200 a sd (5/2).
    • Třetí sloupec je populace b s mean rovným 200, velikostí vzorku n 200 a sd 15.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# List of sites north, east, and west
sites <- list(___)

# Create a list of data frames, each with a years, a, and b column
list_of_df <-  map(___,  
  ~___(___ = .x,
       a = rnorm(mean = ___, n = ___, sd = ___),
       b = rnorm(mean = ___, n = ___, sd = ___)))

list_of_df
Upravit a spustit kód