Bắt đầu ngayBắt đầu miễn phí

Cảm xúc và sắc thái cảm xúc

Trong bộ dữ liệu sentiments, bộ từ vựng nrc chứa một từ điển các từ và cảm xúc gắn với mỗi từ đó. Các cảm xúc như joy, trust, anticipation và những cảm xúc khác có trong bộ dữ liệu này.

Với bộ dữ liệu tweet bot tiếng Nga mà bạn đang khám phá, bạn đã xem các tweet được gửi bởi cả tweet bot khuynh hữu và khuynh tả. Hãy dùng bộ từ vựng nrc để khám phá nội dung các tweet do tweet bot khuynh tả (đảng Dân chủ) gửi. Các tweet khuynh tả, left, đã được tách token thành từ và loại bỏ stop-word.

Bài tập này là một phần của khóa học

Nhập môn Xử lý Ngôn ngữ Tự nhiên với R

Xem khóa học

Hướng dẫn bài tập

  • Tạo một tibble chỉ gồm các từ thuộc cảm xúc anticipation từ bộ từ vựng nrc.
  • Tạo một tibble chỉ gồm các từ thuộc cảm xúc joy từ bộ từ vựng nrc.
  • In ra các từ anticipation xuất hiện nhiều nhất trong left_tokens.
  • In ra các từ joy xuất hiện nhiều nhất trong left_tokens.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

left_tokens <- left %>%
  unnest_tokens(output = "word", token = "words", input = content) %>%
  anti_join(stop_words)
# Dictionaries 
anticipation <- ___("nrc") %>% 
  ___(sentiment == "anticipation")
joy <- ___("nrc") %>% 
  ___(sentiment == "joy")
# Print top words for Anticipation and Joy
left_tokens %>%
  ___(anticipation, by = "word") %>%
  ___(word, sort = TRUE)
left_tokens %>%
  ___(joy, by = "word") %>%
  ___(word, sort = TRUE)
Chỉnh sửa và Chạy Mã