Odstranění vlastních stop slov
Populární výrazy v textovém korpusu lze vizualizovat pomocí sloupcových grafů nebo slovních mraků.
Před použitím vizualizačních nástrojů je ale důležité nejprve z korpusu odstranit vlastní stop slova.
V tomto cvičení zkontroluješ frekvence výrazů a odstraníš vlastní stop slova z textového korpusu, který jsi vytvořil/a pro "telemedicine".
Textový korpus je předem načtený jako twt_corpus.
Knihovny qdap a tm jsou pro toto cvičení předem načtené.
Toto cvičení je součástí kurzu
Analýza dat ze sociálních médií v R
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Extract term frequencies for top 60 words and view output
termfreq <- ___(twt_corpus, ___)
termfreq