Porovnání výsledků
Jak jsme viděli, směsový model přiřadí každému pozorování pravděpodobnost příslušnosti ke každému klastru. Pokud ale chceme každé pozorování přiřadit do klastru s nejvyšší pravděpodobností, můžeme použít funkci clusters() z balíčku flexmix.
Protože dataset mix_example vznikl simulací, máme k dispozici skutečné štítky každého pozorování. Najdeš je v proměnné assignment. Cílem tohoto cvičení je porovnat štítky přiřazené funkcí clusters() se skutečnými přiřazeními.
Toto cvičení je součástí kurzu
Mixture Models v R
Pokyny k cvičení
- Prozkoumej prvních šest prvků vrácených funkcí
clusters(). - Prozkoumej prvních šest prvků skutečných štítků.
- Pomocí funkce
table()vytvoř frekvenční tabulku, kde řádky odpovídají skutečným štítkům a sloupce předpovězeným štítkům.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))