ПочатиПочніть безкоштовно

Підсумовування даних

Тепер створімо фасетований графік, щоб порівняти корисність різних навчальних платформ.

У цій вправі ми познайомимося з новою функцією dplyr, add_count(). add_count() додає до набору даних стовпець n, зберігаючи ту саму кількість рядків, що й в оригіналі. Так само як і count(), значення n за замовчуванням дорівнює кількості рядків у кожній групі, але це можна змінити за допомогою аргументу wt (вага). Якщо призначити wt іншому стовпцю, тоді n стане сумою цього стовпця для кожної групи.

Припустімо, ви хочете додати до iris стовпець із сумою Petal.Length для всіх квіток одного й того самого Species. Ви б написали:

iris %>%
   add_count(Species, wt = Petal.Length) %>%
   select(Species, Petal.Length, n)

Результат буде таким:

# A tibble: 150 x 3
   Species Petal.Length     n
   <fct>          <dbl> <dbl>
 1 setosa           1.4  73.1
 2 setosa           1.4  73.1
 3 virginica        6.4  278.

Ця вправа є частиною курсу

Категоріальні дані в Tidyverse

Переглянути курс

Інтерактивна практична вправа

Спробуйте виконати цю вправу, доповнивши цей зразок коду.

learning_platform_usefulness %>%
  # Change dataset to one row per learning_platform usefulness pair with number of entries for each
  ___(___, ___)
Редагувати та запускати код