Chuẩn bị dữ liệu
Bạn đang xây dựng một mô hình Machine Learning sử dụng NLP cho dự án phân tích cảm xúc để phân loại đánh giá nhà hàng thành tích cực, tiêu cực hoặc trung tính. Để chuẩn bị dữ liệu huấn luyện, bạn cần tiền xử lý và biểu diễn dữ liệu văn bản dưới dạng số.
Tập dữ liệu của bạn có hàng nghìn đánh giá, trong đó có một câu:
"Món ăn rất ngon, nhưng phục vụ cực kỳ chậm."
Những bước tiền xử lý văn bản nào nhiều khả năng sẽ loại bỏ các từ "but" và "was" khỏi đánh giá này?
Bài tập này là một phần của khóa học
Các khái niệm về Large Language Models (LLMs)
Bài tập tương tác thực hành
Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi
Bắt đầu bài tập