Použití stat_sum
V datasetu Vocab jsou proměnné education a vocabulary celočíselného typu. V úvodním kurzu jsi viděl/a, že to je jedna ze čtyř příčin přeplotování. Výsledkem by byl jediný bod v každém průsečíku mezi oběma proměnnými.
Jedno řešení, ukázané v kroku 1, je jitter s průhledností. Další možností je použít stat_sum(), které spočítá celkový počet překrývajících se pozorování a namapuje ho na estetiku size.
stat_sum() podporuje speciální proměnnou ..prop.., která zobrazuje podíl hodnot v rámci datasetu.
Toto cvičení je součástí kurzu
Intermediate Data Visualization with ggplot2
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Run this, look at the plot, then update it
ggplot(Vocab, aes(x = education, y = vocabulary)) +
# Replace this with a sum stat
geom_jitter(alpha = 0.25)