Использование stat_sum
В наборе данных Vocab переменные education и vocabulary являются целочисленными. В первом курсе вы узнали, что это одна из четырёх причин перекрытия точек (overplotting). В результате в каждой точке пересечения двух переменных отображается лишь одна точка.
Одно из решений, показанное на шаге 1, — добавление дрожания (jittering) с прозрачностью. Другое решение — использование stat_sum(), которая вычисляет общее количество перекрывающихся наблюдений и отображает его через эстетику size.
stat_sum() поддерживает специальную переменную ..prop.., которая показывает долю значений в наборе данных.
Это упражнение является частью курса
Визуализация данных на среднем уровне с ggplot2
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Run this, look at the plot, then update it
ggplot(Vocab, aes(x = education, y = vocabulary)) +
# Replace this with a sum stat
geom_jitter(alpha = 0.25)