시작하기무료로 시작하기

요인을 사용해 단어 빈도 시각화하기

항공사 이름을 포함한 여러 사용자 정의 불용어를 추가하고, 데이터를 이미 정리해 두었어요. 이제 더 나은 시각화를 만들고, 단어 빈도에 따라 내림차순으로 정렬된 단어를 그려 보세요.

이 연습은 강의의 일부입니다

R로 시작하는 텍스트 분석

강의 보기

연습 안내

  • non_complaints에서 100회 초과로 등장하는 용어만 남기세요.
  • 단어 빈도에 따라 word 열을 범주형(factor)으로 재정렬하세요.
  • 새로 만든 단어 열(범주형)을 사용해 막대 그래프를 만드세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

word_counts <- tidy_twitter %>% 
  filter(complaint_label == "Non-Complaint") %>% 
  count(word) %>% 
  # Keep terms that occur more than 100 times
  ___(___) %>% 
  # Reorder word as an ordered factor by word counts
  ___(word2 = ___(___, ___))

# Plot the new word column with type factor
___(___, aes(___, ___)) +
  ___() +
  ___() +
  ggtitle("Non-Complaint Word Counts")
코드 편집 및 실행