Porównanie wyników
Wiemy już, że model mieszanin przypisuje każdej obserwacji prawdopodobieństwo przynależności do każdego klastra. Jeśli jednak chcemy przypisać każdą obserwację do klastra o najwyższym prawdopodobieństwie, możemy skorzystać z funkcji clusters() z pakietu flexmix.
Ponieważ zbiór danych mix_example powstał w wyniku symulacji, dysponujemy prawdziwymi etykietami dla każdej obserwacji. Są one dostępne w zmiennej assignment. Celem tego ćwiczenia jest porównanie etykiet przypisanych przez funkcję clusters() z rzeczywistymi przypisaniami.
To ćwiczenie jest częścią kursu
Modele mieszane w R
Instrukcje do ćwiczenia
- Sprawdź pierwsze sześć elementów zwróconych przez funkcję
clusters(). - Sprawdź pierwsze sześć elementów prawdziwych etykiet.
- Użyj funkcji
table(), aby utworzyć tabelę częstości, w której wiersze odpowiadają prawdziwym etykietom, a kolumny – etykietom przewidywanym.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))