DTM 만들기
tidy_twitter 데이터를 사용해 문서-단어 행렬(DTM)을 만드세요. 여기서는 각 트윗을 하나의 문서로 간주해요. 열 이름을 확인하려면 콘솔에서 tidy_twitter를 출력해 보세요.
이 연습은 강의의 일부입니다
R로 시작하는 텍스트 분석
연습 안내
- 정리된 Twitter 데이터로 시작하세요.
- 각 트윗에서 사용된 각 단어의 빈도를 세세요.
- 트윗별 단어 빈도를 사용해 DTM을 만드세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Start with the tidied Twitter data
___ %>%
# Count each word used in each tweet
___(word, ___) %>%
# Use the word counts by tweet to create a DTM
cast_dtm(___, word, n)