요인을 사용해 단어 빈도 시각화하기
항공사 이름을 포함한 여러 사용자 정의 불용어를 추가하고, 데이터를 이미 정리해 두었어요. 이제 더 나은 시각화를 만들고, 단어 빈도에 따라 내림차순으로 정렬된 단어를 그려 보세요.
이 연습은 강의의 일부입니다
R로 시작하는 텍스트 분석
연습 안내
non_complaints에서 100회 초과로 등장하는 용어만 남기세요.- 단어 빈도에 따라
word열을 범주형(factor)으로 재정렬하세요. - 새로 만든 단어 열(범주형)을 사용해 막대 그래프를 만드세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
word_counts <- tidy_twitter %>%
filter(complaint_label == "Non-Complaint") %>%
count(word) %>%
# Keep terms that occur more than 100 times
___(___) %>%
# Reorder word as an ordered factor by word counts
___(word2 = ___(___, ___))
# Plot the new word column with type factor
___(___, aes(___, ___)) +
___() +
___() +
ggtitle("Non-Complaint Word Counts")