Kom igångKom igång gratis

Enkel slumpmässig sampling

Den enklaste metoden för att ta ett urval ur en population är den du redan har sett. Den kallas enkel slumpmässig sampling (förkortas ibland "SRS") och innebär att rader väljs ut slumpmässigt, en i taget, där varje rad har lika stor chans att väljas som någon annan.

För att lättare se vilka rader som hamnar i urvalet är det praktiskt att lägga till en rad-ID-kolumn i datamängden innan du tar urvalet.

I det här kapitlet tittar vi på samplingsmetoder med hjälp av ett syntetiskt (fiktivt) dataset om personalomsättning från IBM, där "attrition" betyder att en anställd lämnar företaget.

attrition_pop är tillgänglig; dplyr är inläst.

Den här övningen är en del av kursen

Urval i R

Visa kurs

Övningsinstruktioner

  • Visa datamängden attrition_pop. Utforska den i visaren tills du har klart för dig vad den innehåller.
  • Sätt det slumpmässiga fröet till ett valfritt värde.
  • Lägg till en rad-ID-kolumn i datamängden och använd sedan enkel slumpmässig sampling för att hämta 200 rader.
  • Visa urvalsdatamängden attrition_samp. Vad lägger du märke till när det gäller rad-ID:n?

Interaktiv övning med praktiskt arbete

Testa den här övningen genom att slutföra den här exempelkoden.

# View the attrition_pop dataset
___

# Set the seed
___

attrition_samp <- attrition_pop %>% 
  # Add a row ID column
  ___ %>% 
  # Get 200 rows using simple random sampling
  ___

# View the attrition_samp dataset
___
Redigera och kör kod