Bắt đầu ngayBắt đầu miễn phí

Trực quan hóa các từ chung

Giờ đây bạn đã có một corpus chứa các từ xuất hiện trong cả hai tệp tweet về chardonnay và coffee, bạn có thể làm sạch corpus, chuyển nó thành TermDocumentMatrix, rồi thành một ma trận để chuẩn bị cho commonality.cloud().

Hàm commonality.cloud() nhận đối tượng ma trận này, cùng với các đối số bổ sung như max.wordscolors để tùy chỉnh biểu đồ.

commonality.cloud(tdm_matrix, max.words = 100, colors = "springgreen")

Bài tập này là một phần của khóa học

Khai phá văn bản với Bag-of-Words trong R

Xem khóa học

Hướng dẫn bài tập

  • Tạo all_clean bằng cách áp dụng hàm clean_corpus() đã định nghĩa sẵn cho all_corpus.
  • Tạo all_tdm, một TermDocumentMatrix từ all_clean.
  • Tạo all_m bằng cách chuyển all_tdm thành một đối tượng ma trận.
  • Tạo commonality.cloud() từ all_m với max.words = 100colors = "steelblue1".

Bài tập tương tác thực hành trực tiếp

Hãy thử làm bài tập này bằng cách hoàn thành đoạn mã mẫu này.

# Clean the corpus
___ <- ___(___)

# Create all_tdm
___ <- ___(___)

# Create all_m
___ <- ___(___)

# Print a commonality cloud
___(___, ___, ___)
Chỉnh sửa và Chạy Mã