Jämför resultaten
Vi har sett att en blandningsmodell tilldelar varje observation en sannolikhet för att tillhöra respektive kluster. Om vi vill tilldela varje observation det kluster som har högst sannolikhet kan vi använda funktionen clusters() från paketet flexmix.
Eftersom datamängden mix_example är en simulering har vi tillgång till de verkliga etiketterna för varje observation. Dessa finns i variabeln assignment. Målet med den här övningen är att jämföra de etiketter som clusters() tilldelar med de verkliga tilldelningarna.
Den här övningen är en del av kursen
Blandningsmodeller i R
Övningsinstruktioner
- Utforska de sex första elementen från funktionen
clusters(). - Utforska de sex första elementen av de verkliga etiketterna.
- Använd funktionen
table()för att skapa en frekvenstabell där raderna motsvarar de verkliga etiketterna och kolumnerna de förutsagda etiketterna.
Interaktiv övning med praktiskt arbete
Testa den här övningen genom att slutföra den här exempelkoden.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))