Un word cloud simplu
Până în acest punct, ai băut prea multă cafea. În plus, să vezi printre cele mai frecvente cuvinte termeni precum „shop", „morning" și „drinking" nu îți oferă prea multe informații utile.
Ca să sărbătorești că ai ajuns până aici, hai să încercăm cu un alt set de 1000 de tweet-uri. Deocamdată nu știi ce au în comun, dar încearcă să-ți dai seama folosind un word cloud. Valorile frecvenței termenilor din tweet-uri sunt preîncărcate în spațiul tău de lucru.
Un word cloud este o vizualizare a termenilor. Dimensiunea fiecărui cuvânt este, de obicei, proporțională cu frecvența sa, iar în unele cazuri culorile pot indica o altă măsurătoare. Deocamdată păstrăm lucrurile simple: dimensiunea reflectă frecvența individuală a cuvintelor și folosim o singură culoare.
Așa cum ai văzut în videoclip, funcția wordcloud() se folosește astfel:
wordcloud(words, frequencies, max.words = 500, colors = "blue")
Analizele de text mining includ adesea word cloud-uri simple. De fapt, sunt probabil suprafolosite, dar pot fi în continuare utile pentru a înțelege rapid un corpus de text!
term_frequency este încărcat în spațiul tău de lucru.
Acest exercițiu face parte din cursul
Text Mining cu Bag-of-Words în R
Instrucțiuni pentru exercițiu
- Încarcă pachetul
wordcloud. - Afișează primele 10 intrări din
term_frequency. - Extrage termenii aplicând
names()peterm_frequency. Numește vectorul de șiruriterms_vec. - Creează un
wordcloud()folosindterms_vecca cuvinte șiterm_frequencyca valori. Adaugă parametriimax.words = 50șicolors = "red".
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Load wordcloud package
# Print the first 10 entries in term_frequency
# Vector of terms
# Create a word cloud for the values in word_freqs