Данные о преступлениях с `flexmix`
Счётные данные встречаются повсюду: от количества товаров, купленных покупателями в магазине, до числа взаимодействий пользователей в Twitter. Умение выделять ценную информацию в виде подпопуляций со схожим поведением крайне важно для многих задач. Пуассоновские смеси моделей (PMM) — удобный инструмент для кластеризации счётных данных.
Цели этого урока: (1) изучить набор данных, (2) применить PMM со статистическим критерием выбора числа кластеров, (3) проанализировать параметры модели и (4) показать, как сообщества группируются в зависимости от уровня преступности.
Это упражнение является частью курса
Смесевые модели в R
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Check the dimension
___(crimes)
# Check with glimpse
___(crimes)
# Transform into a matrix, without community
matrix_crimes <- crimes %>%
select(-___) %>%
___()
# Check the first values
___(matrix_crimes)