Znajdź wspólne słowa
Wyobraź sobie, że chcesz zwizualizować słowa pojawiające się w wielu dokumentach jednocześnie. Możesz to zrobić za pomocą funkcji commonality.cloud().
Każdy z naszych korpusów – kawowy i chardonnay – składa się z wielu pojedynczych tweetów. Aby potraktować tweety o kawie jako jeden dokument (i analogicznie tweety o chardonnay), użyj funkcji paste() z parametrem collapse = " " na wszystkich tweetach w każdym korpusie. Spowoduje to złączenie wszystkich tweetów (oddzielonych spacją) w jeden wektor. Następnie możesz utworzyć pojedynczy wektor zawierający oba złączone dokumenty.
a_single_string <- paste(a_character_vector, collapse = " ")
Po wykonaniu tych kroków zastosuj to samo podejście, które już znasz, aby utworzyć VCorpus() na podstawie VectorSource z obiektu all_tweets.
To ćwiczenie jest częścią kursu
Eksploracja tekstu metodą Bag-of-Words w R
Instrukcje do ćwiczenia
- Utwórz
all_coffee, używającpaste()zcollapse = " "nacoffee_tweets$text. - Utwórz
all_chardonnay, używającpaste()zcollapse = " "nachardonnay_tweets$text. - Utwórz
all_tweets, używającc()do połączeniaall_coffeeiall_chardonnay. Jako pierwszy element podajall_coffee. - Przekształć
all_tweetsza pomocąVectorSource(). - Utwórz
all_corpus, używającVCorpus()naall_tweets.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create all_coffee
___ <- ___(___, ___)
# Create all_chardonnay
___ <- ___(___, ___)
# Create all_tweets
___ <- ___(___, ___)
# Convert to a vector source
___ <- ___(___)
# Create all_corpus
___ <- ___(___)