bộ từ vựng (lexicon) của tidytext
Trước khi bắt đầu áp dụng phân tích cảm xúc cho văn bản, điều quan trọng là bạn phải hiểu các bộ từ vựng (lexicon) được dùng để hỗ trợ phân tích. Mỗi lexicon có lợi thế riêng khi dùng đúng ngữ cảnh. Trước khi chạy bất kỳ phân tích nào, bạn cần quyết định kiểu cảm xúc mà bạn muốn trích xuất từ văn bản hiện có.
Trong bài tập này, bạn sẽ khám phá ba lexicon khác nhau được cung cấp trong bộ dữ liệu cảm xúc của tidytext.
Bài tập này là một phần của khóa học
Nhập môn Xử lý Ngôn ngữ Tự nhiên với R
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
# Print the lexicon
get_sentiments(___)
# Count the different sentiment types
get_sentiments(___) %>%
count(___) %>%
arrange(desc(n))