토큰화와 개수 세기
twitter_data에 있는 항공사 트윗을 단어 개수로 살펴보세요. 각 트윗의 본문은 tweet_text 열에 있어요.
이 연습은 강의의 일부입니다
R로 시작하는 텍스트 분석
연습 안내
- tidyverse와 tidytext 패키지를 불러오세요.
tweet_text열의 트윗을 토큰화하세요.- 토큰화된 텍스트로 단어 개수를 계산하세요.
- 개수를 내림차순으로 정렬하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Load the tidyverse and tidytext packages
___(___)
___(___)
tidy_twitter <- twitter_data %>%
# Tokenize the twitter data
___(word, ___)
tidy_twitter %>%
# Compute word counts
___(___) %>%
# Arrange the counts in descending order
___(___)