공통 단어 시각화
이제 샤르도네와 커피 트윗 파일에서 공통으로 사용된 단어로 채워진 코퍼스가 있으니, 코퍼스를 정제하고 TermDocumentMatrix로 변환한 뒤, 다시 행렬로 변환해 commonality.cloud()를 준비해 보세요.
commonality.cloud() 함수는 이 행렬 객체를 입력으로 받으며, max.words, colors 같은 추가 인수를 사용해 플롯을 더 맞춤 설정할 수 있습니다.
commonality.cloud(tdm_matrix, max.words = 100, colors = "springgreen")
이 연습은 강의의 일부입니다
R로 배우는 Bag-of-Words 텍스트 마이닝
연습 안내
- 미리 정의된
clean_corpus()함수를all_corpus에 적용해all_clean을 만드세요. all_clean으로부터TermDocumentMatrix인all_tdm을 만드세요.all_tdm을 행렬 객체로 변환해all_m을 만드세요.all_m을 사용해max.words = 100,colors = "steelblue1"로commonality.cloud()를 생성하세요.
실습형 인터랙티브 연습
이 예제를 이 샘플 코드를 완성하여 풀어보세요.
# Clean the corpus
___ <- ___(___)
# Create all_tdm
___ <- ___(___)
# Create all_m
___ <- ___(___)
# Print a commonality cloud
___(___, ___, ___)