Začněte nyníZačněte zdarma

Odstranění vlastních stop slov

Populární výrazy v textovém korpusu lze vizualizovat pomocí sloupcových grafů nebo slovních mraků.

Před použitím vizualizačních nástrojů je ale důležité nejprve z korpusu odstranit vlastní stop slova.

V tomto cvičení zkontroluješ frekvence výrazů a odstraníš vlastní stop slova z textového korpusu, který jsi vytvořil/a pro "telemedicine".

Textový korpus je předem načtený jako twt_corpus.

Knihovny qdap a tm jsou pro toto cvičení předem načtené.

Toto cvičení je součástí kurzu

Analýza dat ze sociálních médií v R

Zobrazit kurz

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Extract term frequencies for top 60 words and view output
termfreq  <-  ___(twt_corpus, ___)
termfreq
Upravit a spustit kód