Zacznij terazZacznij za darmo

Wizualizacja wspólnych słów

Masz już korpus wypełniony słowami z plików tweetów o chardonnay i kawie – czas go wyczyścić, przekształcić w TermDocumentMatrix, a następnie w macierz, aby przygotować dane dla funkcji commonality.cloud().

Funkcja commonality.cloud() przyjmuje ten obiekt macierzy oraz dodatkowe argumenty, takie jak max.words i colors, które pozwalają dostosować wygląd wykresu.

commonality.cloud(tdm_matrix, max.words = 100, colors = "springgreen")

To ćwiczenie jest częścią kursu

Eksploracja tekstu metodą Bag-of-Words w R

Zobacz kurs

Instrukcje do ćwiczenia

  • Utwórz all_clean, stosując predefiniowaną funkcję clean_corpus() do all_corpus.
  • Utwórz all_tdm – obiekt TermDocumentMatrix na podstawie all_clean.
  • Utwórz all_m, konwertując all_tdm na obiekt macierzy.
  • Utwórz chmurę słów commonality.cloud() na podstawie all_m, ustawiając max.words = 100 i colors = "steelblue1".

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Clean the corpus
___ <- ___(___)

# Create all_tdm
___ <- ___(___)

# Create all_m
___ <- ___(___)

# Print a commonality cloud
___(___, ___, ___)
Edytuj i uruchom kod