Сравнение результатов
Мы уже знаем, что модель смеси присваивает каждому наблюдению вероятность принадлежности к каждому кластеру. Однако если нужно отнести каждое наблюдение к кластеру с максимальной вероятностью, можно воспользоваться функцией clusters() из пакета flexmix.
Поскольку набор данных mix_example был получен путём симуляции, у нас есть настоящие метки для каждого наблюдения. Они хранятся в переменной assignment. Цель этого упражнения — сравнить метки, назначенные функцией clusters(), с реальными.
Это упражнение является частью курса
Смесевые модели в R
Инструкции к упражнению
- Изучите первые шесть элементов, возвращаемых функцией
clusters(). - Изучите первые шесть элементов настоящих меток.
- Используйте функцию
table(), чтобы построить таблицу частот, где строки соответствуют настоящим меткам, а столбцы — предсказанным.
Интерактивное практическое упражнение
Попробуйте выполнить это упражнение, дополнив этот пример кода.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))