Bắt đầu ngayBắt đầu miễn phí

Trực quan hóa tần suất từ bằng factors

Mình đã thêm một số stop words tùy chỉnh khác (bao gồm cả tên các hãng hàng không) và dọn dữ liệu sẵn cho bạn. Bây giờ bạn sẽ tạo một biểu đồ tốt hơn và sắp xếp các từ theo thứ tự giảm dần theo số lần xuất hiện.

Bài tập này là một phần của khóa học

Nhập môn Phân tích Văn bản bằng R

Xem khóa học

Hướng dẫn bài tập

  • Chỉ giữ các thuật ngữ xuất hiện hơn 100 lần trong non_complaints.
  • Sắp xếp lại cột word dưới dạng factor theo số lần xuất hiện của từ.
  • Tạo biểu đồ cột dùng cột từ mới có kiểu factor.

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

word_counts <- tidy_twitter %>% 
  filter(complaint_label == "Non-Complaint") %>% 
  count(word) %>% 
  # Keep terms that occur more than 100 times
  ___(___) %>% 
  # Reorder word as an ordered factor by word counts
  ___(word2 = ___(___, ___))

# Plot the new word column with type factor
___(___, aes(___, ___)) +
  ___() +
  ___() +
  ggtitle("Non-Complaint Word Counts")
Chỉnh sửa và Chạy Mã