Bắt đầu ngayBắt đầu miễn phí

So sánh kết quả

Chúng ta đã thấy rằng một mô hình hỗn hợp gán cho mỗi quan sát một xác suất thuộc về mỗi cụm. Tuy nhiên, nếu bạn muốn gán mỗi quan sát vào cụm có xác suất lớn nhất, bạn có thể dùng hàm clusters() từ gói flexmix.

Vì bộ dữ liệu mix_example là dữ liệu mô phỏng, chúng ta thực sự có nhãn thật cho từng quan sát. Các nhãn này nằm trong biến assignment. Mục tiêu trong bài tập này là so sánh các nhãn do hàm clusters() gán với các nhãn thực tế.

Bài tập này là một phần của khóa học

Các Mô hình Hỗn hợp trong R

Xem khóa học

Hướng dẫn bài tập

  • Xem 6 phần tử đầu tiên của đầu ra hàm clusters().
  • Xem 6 phần tử đầu tiên của các nhãn thực tế.
  • Dùng hàm table() để tạo bảng tần số, trong đó các hàng là nhãn thực tế và các cột là nhãn dự đoán.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Explore the first assignments
___(___(fit_mix_example))

# Explore the first real labels
___(mix_example$___)

# Create frequency table
___(___, clusters(fit_mix_example))
Chỉnh sửa và Chạy Mã