Pohled na výsledky podle provincií
Celkové počty hlasů jsou sice nejdůležitější, ale data můžeš prozkoumat hlouběji – třeba pomocí geografických informací. V tomto cvičení se podíváš na to, jak se výsledky lišily podle jednotlivých provincií.
Vyhrál Ahmadínežád v celé zemi, nebo existovaly provincie, kde se na první místo dostal jiný kandidát? Začni tím, že vytvoříš datovou sadu na úrovni provincií.
Toto cvičení je součástí kurzu
Inference for Categorical Data in R
Pokyny k cvičení
- Začni s datovou sadou
iran, seskup ji podle provincie a pak ji shrň do dvou proměnných: součet hlasů kandidáta na prvním místě a součet hlasů kandidáta na druhém místě. Každý nový sloupec pojmenuj podle příslušného kandidáta. - Prohlédni si
province_totals. - Filtruj
province_totalstak, aby zůstaly jen řádky, kde kandidát na druhém místě získal více hlasů než kandidát na prvním místě.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Construct province-level dataset
province_totals <- ___ %>%
# Group by province
___ %>%
# Sum up votes for top two candidates
___
# Inspect data frame
province_totals
# Filter for won provinces won by #2
___ %>%
___(___ > ___)