Évaluer l'effort de l'auteur
Il arrive souvent que les auteurs utilisent plus de mots lorsqu'ils sont plus passionnés. Par exemple, un passager d'avion fâché laissera un avis plus long si le service (perçu) a été mauvais. À l'inverse, un passager moins émotif ne se sentira peut-être pas tenu de passer beaucoup de temps à rédiger un avis. Les avis très longs peuvent gonfler le ressenti global, puisqu'ils contiendront intrinsèquement plus de langage positif ou négatif à mesure qu'ils s'allongent. Cet exercice de codage permet d'examiner l'effort et le ressenti.
Dans cet exercice, vous allez visualiser la relation entre l'effort et le sentiment. Rappelez-vous que votre tibble d'avis de locations contient un id et qu'un mot est représenté à chaque ligne. Ainsi, un simple count() sur id permettra de saisir le nombre de mots utilisés dans chaque avis. Vous joindrez ensuite ce sommaire aux données positives et négatives. Au final, vous créerez un nuage de points qui visualisera la longueur de l'avis rédigé par l'auteur et sa relation avec la polarité.
Cette activité fait partie du cours
Analyse de sentiment en R
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Review tidy_reviews and pos_neg
tidy_reviews
pos_neg
pos_neg_pol <- tidy_reviews %>%
# Effort is measured as count by id
___(___) %>%
# Inner join to pos_neg
___(___) %>%
# Add polarity status
___(pol = ___(___, "___", "___"))
# Examine results
pos_neg_pol