Агрегирование данных по теме
Ранее вы объединяли таблицы, чтобы сравнивать темы. Прежде чем перейти к сравнению, полезно агрегировать данные — это поможет лучше понять, какие детали входят в каждую тему и какие цвета при этом используются.
Таблица, созданная на предыдущем шаге, уже загружена под именем inventory_sets_themes. Данные отфильтрованы по каждой теме, а результаты сохранены в объектах batman и star_wars.
inventory_sets_themes <- inventory_parts_joined %>%
inner_join(sets, by = "set_num") %>%
inner_join(themes, by = c("theme_id" = "id"), suffix = c("_set", "_theme"))
batman <- inventory_sets_themes %>%
filter(name_theme == "Batman")
star_wars <- inventory_sets_themes %>%
filter(name_theme == "Star Wars")
Это упражнение является частью курса
Объединение данных с dplyr
Инструкции к упражнению
- Подсчитайте количество деталей по номеру детали и идентификатору цвета для наборов Batman и Star Wars, взвесив результат по количеству (
quantity).
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Count the part number and color id, weight by quantity
batman %>%
___
star_wars %>%
___