Агрегування наборів, щоб подивитися на їх відмінності
Щоб порівняти два окремі набори та типи деталей LEGO, з яких вони складаються, нам потрібно агрегувати дані за окремими темами. Крім того, як показано у відео, варто додати стовпчик, щоб бачити частки конкретних деталей у кожному наборі, а не лише кількість деталей.
Таблицю inventory_parts_themes уже завантажено для вас.
inventory_parts_themes <- inventories %>%
inner_join(inventory_parts, by = c("id" = "inventory_id")) %>%
arrange(desc(quantity)) %>%
select(-id, -version) %>%
inner_join(sets, by = "set_num") %>%
inner_join(themes, by = c("theme_id" = "id"), suffix = c("_set", "_theme"))
Ця вправа є частиною курсу
Об'єднання даних із dplyr
Інструкції до вправи
- Додайте фільтр для теми
"Batman", щоб створити об'єктbatman_colors. - Додайте стовпчик
fractionдоbatman_colors, який показує total, поділений на суму total. - Повторіть кроки фільтрування та агрегування для даних наборів
"Star Wars", щоб створити об'єктstar_wars_colors. - Додайте стовпчик
fractionдоstar_wars_colors, щоб показати частку від total.
Інтерактивна практична вправа
Спробуйте виконати цю вправу, доповнивши цей зразок коду.
batman_colors <- inventory_parts_themes %>%
# Filter the inventory_parts_themes table for the Batman theme
filter(name_theme == ___) %>%
group_by(color_id) %>%
summarize(total = sum(quantity)) %>%
# Add a fraction column of the total divided by the sum of the total
mutate(___)
# Filter and aggregate the Star Wars set data; add a fraction column
star_wars_colors <- inventory_parts_themes %>%
___