Bắt đầu ngayBắt đầu miễn phí

Chuẩn bị dữ liệu

Bạn đang xây dựng một mô hình Machine Learning sử dụng NLP cho dự án phân tích cảm xúc để phân loại đánh giá nhà hàng thành tích cực, tiêu cực hoặc trung tính. Để chuẩn bị dữ liệu huấn luyện, bạn cần tiền xử lý và biểu diễn dữ liệu văn bản dưới dạng số.

Tập dữ liệu của bạn có hàng nghìn đánh giá, trong đó có một câu:

"Món ăn rất ngon, nhưng phục vụ cực kỳ chậm."

Những bước tiền xử lý văn bản nào nhiều khả năng sẽ loại bỏ các từ "but" và "was" khỏi đánh giá này?

Bài tập này là một phần của khóa học

Các khái niệm về Large Language Models (LLMs)

Xem khóa học

Bài tập tương tác thực hành

Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi

Bắt đầu bài tập