Enkel slumpmässig sampling
Den enklaste metoden för att ta ett urval ur en population är den du redan har sett. Den kallas enkel slumpmässig sampling (förkortas ibland "SRS") och innebär att rader väljs ut slumpmässigt, en i taget, där varje rad har lika stor chans att väljas som någon annan.
För att lättare se vilka rader som hamnar i urvalet är det praktiskt att lägga till en rad-ID-kolumn i datamängden innan du tar urvalet.
I det här kapitlet tittar vi på samplingsmetoder med hjälp av ett syntetiskt (fiktivt) dataset om personalomsättning från IBM, där "attrition" betyder att en anställd lämnar företaget.
attrition_pop är tillgänglig; dplyr är inläst.
Den här övningen är en del av kursen
Urval i R
Övningsinstruktioner
- Visa datamängden
attrition_pop. Utforska den i visaren tills du har klart för dig vad den innehåller. - Sätt det slumpmässiga fröet till ett valfritt värde.
- Lägg till en rad-ID-kolumn i datamängden och använd sedan enkel slumpmässig sampling för att hämta 200 rader.
- Visa urvalsdatamängden
attrition_samp. Vad lägger du märke till när det gäller rad-ID:n?
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# View the attrition_pop dataset
___
# Set the seed
___
attrition_samp <- attrition_pop %>%
# Add a row ID column
___ %>%
# Get 200 rows using simple random sampling
___
# View the attrition_samp dataset
___