Trực quan hóa tần suất từ bằng factors
Mình đã thêm một số stop words tùy chỉnh khác (bao gồm cả tên các hãng hàng không) và dọn dữ liệu sẵn cho bạn. Bây giờ bạn sẽ tạo một biểu đồ tốt hơn và sắp xếp các từ theo thứ tự giảm dần theo số lần xuất hiện.
Bài tập này là một phần của khóa học
Nhập môn Phân tích Văn bản bằng R
Hướng dẫn bài tập
- Chỉ giữ các thuật ngữ xuất hiện hơn 100 lần trong
non_complaints. - Sắp xếp lại cột
worddưới dạng factor theo số lần xuất hiện của từ. - Tạo biểu đồ cột dùng cột từ mới có kiểu factor.
Bài tập tương tác thực hành trực tiếp
Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.
word_counts <- tidy_twitter %>%
filter(complaint_label == "Non-Complaint") %>%
count(word) %>%
# Keep terms that occur more than 100 times
___(___) %>%
# Reorder word as an ordered factor by word counts
___(word2 = ___(___, ___))
# Plot the new word column with type factor
___(___, aes(___, ___)) +
___() +
___() +
ggtitle("Non-Complaint Word Counts")