Підсумовування даних
Тепер створімо фасетований графік, щоб порівняти корисність різних навчальних платформ.
У цій вправі ми познайомимося з новою функцією dplyr, add_count(). add_count() додає до набору даних стовпець n, зберігаючи ту саму кількість рядків, що й в оригіналі. Так само як і count(), значення n за замовчуванням дорівнює кількості рядків у кожній групі, але це можна змінити за допомогою аргументу wt (вага). Якщо призначити wt іншому стовпцю, тоді n стане сумою цього стовпця для кожної групи.
Припустімо, ви хочете додати до iris стовпець із сумою Petal.Length для всіх квіток одного й того самого Species. Ви б написали:
iris %>%
add_count(Species, wt = Petal.Length) %>%
select(Species, Petal.Length, n)
Результат буде таким:
# A tibble: 150 x 3
Species Petal.Length n
<fct> <dbl> <dbl>
1 setosa 1.4 73.1
2 setosa 1.4 73.1
3 virginica 6.4 278.
Ця вправа є частиною курсу
Категоріальні дані в Tidyverse
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
learning_platform_usefulness %>%
# Change dataset to one row per learning_platform usefulness pair with number of entries for each
___(___, ___)