Usuwanie niestandardowych słów stopu
Popularne terminy w korpusie tekstowym można wizualizować za pomocą wykresów słupkowych lub chmur słów.
Przed użyciem narzędzi do wizualizacji warto jednak najpierw usunąć niestandardowe słowa stopu obecne w korpusie.
W tym ćwiczeniu sprawdzisz częstości terminów i usuniesz niestandardowe słowa stopu z korpusu tekstowego utworzonego dla "telemedicine".
Korpus tekstowy został wstępnie załadowany jako twt_corpus.
Biblioteki qdap i tm zostały wstępnie załadowane na potrzeby tego ćwiczenia.
To ćwiczenie jest częścią kursu
Analiza danych z mediów społecznościowych w R
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Extract term frequencies for top 60 words and view output
termfreq <- ___(twt_corpus, ___)
termfreq