시작하기무료로 시작하기

공통 단어 시각화

이제 샤르도네와 커피 트윗 파일에서 공통으로 사용된 단어로 채워진 코퍼스가 있으니, 코퍼스를 정제하고 TermDocumentMatrix로 변환한 뒤, 다시 행렬로 변환해 commonality.cloud()를 준비해 보세요.

commonality.cloud() 함수는 이 행렬 객체를 입력으로 받으며, max.words, colors 같은 추가 인수를 사용해 플롯을 더 맞춤 설정할 수 있습니다.

commonality.cloud(tdm_matrix, max.words = 100, colors = "springgreen")

이 연습은 강의의 일부입니다

R로 배우는 Bag-of-Words 텍스트 마이닝

강의 보기

연습 안내

  • 미리 정의된 clean_corpus() 함수를 all_corpus에 적용해 all_clean을 만드세요.
  • all_clean으로부터 TermDocumentMatrixall_tdm을 만드세요.
  • all_tdm을 행렬 객체로 변환해 all_m을 만드세요.
  • all_m을 사용해 max.words = 100, colors = "steelblue1"commonality.cloud()를 생성하세요.

실습형 인터랙티브 연습

이 예제를 이 샘플 코드를 완성하여 풀어보세요.

# Clean the corpus
___ <- ___(___)

# Create all_tdm
___ <- ___(___)

# Create all_m
___ <- ___(___)

# Print a commonality cloud
___(___, ___, ___)
코드 편집 및 실행