Začněte nyníZačněte zdarma

Použití stat_sum

V datasetu Vocab jsou proměnné education a vocabulary celočíselného typu. V úvodním kurzu jsi viděl/a, že to je jedna ze čtyř příčin přeplotování. Výsledkem by byl jediný bod v každém průsečíku mezi oběma proměnnými.

Jedno řešení, ukázané v kroku 1, je jitter s průhledností. Další možností je použít stat_sum(), které spočítá celkový počet překrývajících se pozorování a namapuje ho na estetiku size.

stat_sum() podporuje speciální proměnnou ..prop.., která zobrazuje podíl hodnot v rámci datasetu.

Toto cvičení je součástí kurzu

Intermediate Data Visualization with ggplot2

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Run this, look at the plot, then update it
ggplot(Vocab, aes(x = education, y = vocabulary)) +
  # Replace this with a sum stat
  geom_jitter(alpha = 0.25)
Upravit a spustit kód