LDA 적합하기
이제 첫 번째 토픽 모델을 실행해 볼 시간이에요! 앞에서 설명했듯이 LDA() 함수의 세 가지 추가 인수는 토픽 모델을 제대로 실행하는 데 매우 중요합니다. LDA() 함수를 실행하는 데 약 10초 정도 걸릴 수 있다는 점을 참고하세요. tidyverse와 tidytext 패키지, 그리고 tidy_twitter 데이터셋은 미리 로드되어 있습니다.
이 연습은 강의의 일부입니다
R로 시작하는 텍스트 분석
연습 안내
topicmodels패키지를 로드하세요.- 트윗별 단어 빈도를 DTM으로 변환하세요.
- 토픽 2개와 Gibbs 샘플러로 LDA를 실행하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Load the topicmodels package
___
# Cast the word counts by tweet into a DTM
dtm_twitter <- ___ %>%
___(___) %>%
___(___)
# Run an LDA with 2 topics and a Gibbs sampler
lda_out <- LDA(
___,
k = ___,
method = ___,
control = list(seed = 42)
)