Стовпчикові діаграми: використання агрегованих даних
Якщо для цієї задачі справді доречні стовпчикові діаграми (дивіться відео!), варто дати уявлення про кількість значень у кожній групі.
stat_summary() не відстежує кількість. stat_sum() відстежує (власне, для цього він і створений), але доступ до нього незручний. Простіше самостійно обчислити саме те, що ми хочемо зобразити.
Тут ми створили підсумковий датафрейм mtcars_by_cyl, який містить середні значення (mean_wt), стандартні відхилення (sd_wt) і кількість спостережень (n_wt) для ваг автомобілів у кожній групі циліндрів cyl. Він також містить частку (prop) кожної групи циліндрів у всьому наборі даних. Скористайтеся консоллю, щоб ознайомитися з датафреймом mtcars_by_cyl.
Ця вправа є частиною курсу
Середній рівень візуалізації даних у ggplot2
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
# Using mtcars_cyl, plot mean_wt vs. cyl
___ +
# Add a bar layer with identity stat, filled skyblue
___