So sánh kết quả
Chúng ta đã thấy rằng một mô hình hỗn hợp gán cho mỗi quan sát một xác suất thuộc về mỗi cụm. Tuy nhiên, nếu bạn muốn gán mỗi quan sát vào cụm có xác suất lớn nhất, bạn có thể dùng hàm clusters() từ gói flexmix.
Vì bộ dữ liệu mix_example là dữ liệu mô phỏng, chúng ta thực sự có nhãn thật cho từng quan sát. Các nhãn này nằm trong biến assignment. Mục tiêu trong bài tập này là so sánh các nhãn do hàm clusters() gán với các nhãn thực tế.
Bài tập này là một phần của khóa học
Các Mô hình Hỗn hợp trong R
Hướng dẫn bài tập
- Xem 6 phần tử đầu tiên của đầu ra hàm
clusters(). - Xem 6 phần tử đầu tiên của các nhãn thực tế.
- Dùng hàm
table()để tạo bảng tần số, trong đó các hàng là nhãn thực tế và các cột là nhãn dự đoán.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Explore the first assignments
___(___(fit_mix_example))
# Explore the first real labels
___(mix_example$___)
# Create frequency table
___(___, clusters(fit_mix_example))