시작하기무료로 시작하기

LDA 적합하기

이제 첫 번째 토픽 모델을 실행해 볼 시간이에요! 앞에서 설명했듯이 LDA() 함수의 세 가지 추가 인수는 토픽 모델을 제대로 실행하는 데 매우 중요합니다. LDA() 함수를 실행하는 데 약 10초 정도 걸릴 수 있다는 점을 참고하세요. tidyversetidytext 패키지, 그리고 tidy_twitter 데이터셋은 미리 로드되어 있습니다.

이 연습은 강의의 일부입니다

R로 시작하는 텍스트 분석

강의 보기

연습 안내

  • topicmodels 패키지를 로드하세요.
  • 트윗별 단어 빈도를 DTM으로 변환하세요.
  • 토픽 2개와 Gibbs 샘플러로 LDA를 실행하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Load the topicmodels package
___

# Cast the word counts by tweet into a DTM
dtm_twitter <- ___ %>% 
  ___(___) %>% 
  ___(___)

# Run an LDA with 2 topics and a Gibbs sampler
lda_out <- LDA(
  ___,
  k = ___,
  method = ___,
  control = list(seed = 42)
)
코드 편집 및 실행