NYC SAT Scores EDA
Matematika je předmět, ve kterém USA dlouhodobě zaostávají za zbytkem světa, takže naše experimenty se zaměří právě na skóre z matematiky. Původní dataset pochází z otevřených dat dostupných na Kaggle. V průběhu této kapitoly k němu přidám několik proměnných, díky nimž si budeš moct zahrát na výzkumníka/výzkumnici v oblasti vzdělávání, který/á navrhuje experimenty s cílem zlepšit výsledky studentů a zvýšit jejich šance na přijetí na vysokou školu.
Než se pustíme do analýzy experimentů, uděláme nejdřív EDA, abychom datové sadě nyc_scores pořádně porozuměli. V této lekci budeme provádět experimenty s blokováním podle Borough a Teacher_Education_Level, takže se podívejme na výsledky z matematiky v závislosti na těchto proměnných. Dataset nyc_scores je již načtený.
Toto cvičení je součástí kurzu
Experimental Design in R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Mean, var, and median of Math score
nyc_scores %>%
___(___) %>%
___(mean = ___(___, na.rm = TRUE),
var = ___(___, na.rm = TRUE),
median = ___(___, na.rm = TRUE))