Cảm xúc và sắc thái cảm xúc
Trong bộ dữ liệu sentiments, bộ từ vựng nrc chứa một từ điển các từ và cảm xúc gắn với mỗi từ đó. Các cảm xúc như joy, trust, anticipation và những cảm xúc khác có trong bộ dữ liệu này.
Với bộ dữ liệu tweet bot tiếng Nga mà bạn đang khám phá, bạn đã xem các tweet được gửi bởi cả tweet bot khuynh hữu và khuynh tả. Hãy dùng bộ từ vựng nrc để khám phá nội dung các tweet do tweet bot khuynh tả (đảng Dân chủ) gửi. Các tweet khuynh tả, left, đã được tách token thành từ và loại bỏ stop-word.
Bài tập này là một phần của khóa học
Nhập môn Xử lý Ngôn ngữ Tự nhiên với R
Hướng dẫn bài tập
- Tạo một tibble chỉ gồm các từ thuộc cảm xúc anticipation từ bộ từ vựng
nrc. - Tạo một tibble chỉ gồm các từ thuộc cảm xúc joy từ bộ từ vựng
nrc. - In ra các từ
anticipationxuất hiện nhiều nhất trongleft_tokens. - In ra các từ
joyxuất hiện nhiều nhất trongleft_tokens.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
left_tokens <- left %>%
unnest_tokens(output = "word", token = "words", input = content) %>%
anti_join(stop_words)
# Dictionaries
anticipation <- ___("nrc") %>%
___(sentiment == "anticipation")
joy <- ___("nrc") %>%
___(sentiment == "joy")
# Print top words for Anticipation and Joy
left_tokens %>%
___(anticipation, by = "word") %>%
___(word, sort = TRUE)
left_tokens %>%
___(joy, by = "word") %>%
___(word, sort = TRUE)