Kom igångKom igång gratis

Omsampling av NHANES-data

NHANES-data samlas in från utvalda individer som är specifikt valda för att representera den amerikanska befolkningen. Låt oss ändå sampla om datamängden nhanes_final på olika sätt för att bekanta oss med de olika urvalsmetoderna.

Ett enkelt slumpmässigt urval kan göras med slice_sample() från dplyr. Funktionen tar en datamängd och ett heltal för antalet rader att sampla som indata.

Stratifierat urval görs genom att kombinera group_by() och slice_sample(). Funktionen samplar n observationer från var och en av de grupper som anges i group_by().

Funktionen cluster() i paketet sampling skapar klusterurval. Den tar in ett datamängdsnamn, den variabel som ska användas som klustervariabel – angiven som en vektor med namnet som sträng (t.ex. c("variable")) – ett antal kluster att välja, samt en metod.

Den här övningen är en del av kursen

Experimentell design i R

Visa kurs

Övningsinstruktioner

  • Använd slice_sample() för att välja ut 2 500 observationer från nhanes_final och spara resultatet som nhanes_srs.
  • Skapa nhanes_stratified genom att använda group_by() och slice_sample(). Stratifiera efter riagendr och välj 2 000 observationer per kön. Kontrollera att det fungerade genom att använda count() för att granska könsvariabeln i nhanes_stratified.
  • Läs in paketet sampling. Använd cluster() för att dela upp nhanes_final efter "indhhin2" i 6 kluster med metoden "srswor". Spara resultatet som nhanes_cluster.

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# Use slice_sample() to create nhanes_srs
nhanes_srs <- ___ %>% ___(n=___)

# Create nhanes_stratified with group_by() and slice_sample()
___ <- ___ %>% group_by(___) %>% ___(n=___)
nhanes_stratified %>% ___

# Load sampling package and create nhanes_cluster with cluster()
___
nhanes_cluster <- cluster(___, "___", 6, method = "srswor")
Redigera och kör kod