Symulowanie danych za pomocą purrr
Podczas pracy z danymi często trzeba najpierw wygenerować dane symulowane, żeby sprawdzić, czy dany pomysł w ogóle ma sens. Na przykład możesz chcieć przetestować modele na danych z określonymi, z góry ustalonymi różnicami – po to, by upewnić się, że modele działają poprawnie.
W tym ćwiczeniu zobaczysz, jak to zrobić za pomocą purrr, symulując dane dla dwóch populacji, a i b, z następujących lokalizacji: "north", "east" i "west". Obie populacje będą losowane z rozkładu normalnego o różnych średnich i odchyleniach standardowych.
To ćwiczenie jest częścią kursu
Podstawy programowania funkcyjnego z purrr
Instrukcje do ćwiczenia
- Utwórz listę nazw lokalizacji: "north", "east" i "west".
- Następnie użyj
map(), aby utworzyć listę ramek danych z trzema kolumnami – pierwsza kolumna tosites.- Druga to populacja
aomeanrównym 5, liczebności próbynwynoszącej 200 isdrównym (5/2). - Trzecia to populacja
bomeanrównym 200, liczebności próbynwynoszącej 200 isdrównym 15.
- Druga to populacja
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# List of sites north, east, and west
sites <- list(___)
# Create a list of data frames, each with a years, a, and b column
list_of_df <- map(___,
~___(___ = .x,
a = rnorm(mean = ___, n = ___, sd = ___),
b = rnorm(mean = ___, n = ___, sd = ___)))
list_of_df