Omsampling av NHANES-data
NHANES-data samlas in från utvalda individer som är specifikt valda för att representera den amerikanska befolkningen. Låt oss ändå sampla om datamängden nhanes_final på olika sätt för att bekanta oss med de olika urvalsmetoderna.
Ett enkelt slumpmässigt urval kan göras med slice_sample() från dplyr. Funktionen tar en datamängd och ett heltal för antalet rader att sampla som indata.
Stratifierat urval görs genom att kombinera group_by() och slice_sample(). Funktionen samplar n observationer från var och en av de grupper som anges i group_by().
Funktionen cluster() i paketet sampling skapar klusterurval. Den tar in ett datamängdsnamn, den variabel som ska användas som klustervariabel – angiven som en vektor med namnet som sträng (t.ex. c("variable")) – ett antal kluster att välja, samt en metod.
Den här övningen är en del av kursen
Experimentell design i R
Övningsinstruktioner
- Använd
slice_sample()för att välja ut 2 500 observationer frånnhanes_finaloch spara resultatet somnhanes_srs. - Skapa
nhanes_stratifiedgenom att användagroup_by()ochslice_sample(). Stratifiera efterriagendroch välj 2 000 observationer per kön. Kontrollera att det fungerade genom att användacount()för att granska könsvariabeln inhanes_stratified. - Läs in paketet
sampling. Användcluster()för att dela uppnhanes_finalefter"indhhin2"i 6 kluster med metoden"srswor". Spara resultatet somnhanes_cluster.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Use slice_sample() to create nhanes_srs
nhanes_srs <- ___ %>% ___(n=___)
# Create nhanes_stratified with group_by() and slice_sample()
___ <- ___ %>% group_by(___) %>% ___(n=___)
nhanes_stratified %>% ___
# Load sampling package and create nhanes_cluster with cluster()
___
nhanes_cluster <- cluster(___, "___", 6, method = "srswor")