시작하기무료로 시작하기

토큰화와 개수 세기

twitter_data에 있는 항공사 트윗을 단어 개수로 살펴보세요. 각 트윗의 본문은 tweet_text 열에 있어요.

이 연습은 강의의 일부입니다

R로 시작하는 텍스트 분석

강의 보기

연습 안내

  • tidyverse와 tidytext 패키지를 불러오세요.
  • tweet_text 열의 트윗을 토큰화하세요.
  • 토큰화된 텍스트로 단어 개수를 계산하세요.
  • 개수를 내림차순으로 정렬하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Load the tidyverse and tidytext packages
___(___)
___(___)

tidy_twitter <- twitter_data %>% 
  # Tokenize the twitter data
  ___(word, ___) 

tidy_twitter %>% 
  # Compute word counts
  ___(___) %>% 
  # Arrange the counts in descending order
  ___(___)
코드 편집 및 실행