Zacznij terazZacznij za darmo

Usuwanie niestandardowych słów stopu

Popularne terminy w korpusie tekstowym można wizualizować za pomocą wykresów słupkowych lub chmur słów.

Przed użyciem narzędzi do wizualizacji warto jednak najpierw usunąć niestandardowe słowa stopu obecne w korpusie.

W tym ćwiczeniu sprawdzisz częstości terminów i usuniesz niestandardowe słowa stopu z korpusu tekstowego utworzonego dla "telemedicine".

Korpus tekstowy został wstępnie załadowany jako twt_corpus.

Biblioteki qdap i tm zostały wstępnie załadowane na potrzeby tego ćwiczenia.

To ćwiczenie jest częścią kursu

Analiza danych z mediów społecznościowych w R

Zobacz kurs

Interaktywne ćwiczenie praktyczne

Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.

# Extract term frequencies for top 60 words and view output
termfreq  <-  ___(twt_corpus, ___)
termfreq
Edytuj i uruchom kod