Préciser le modèle de jetons
Dans cet exercice, vous allez travailler avec la colonne text de l'ensemble de données tweets. Votre tâche consiste à vectoriser cette colonne de type objet à l'aide de CountVectorizer. Vous allez appliquer différents modèles de jetons dans le vectoriseur. Rappelez‑vous qu'en précisant le modèle de jetons, vous pouvez filtrer certains caractères.
Le CountVectorizer a déjà été importé pour vous.
Cette activité fait partie du cours
Analyse de sentiment en Python
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Build and fit the vectorizer
vect = ____(____=r'\b[^\d\W][^\d\W]+\b').fit(tweets.text)
vect.transform(tweets.text)
print('Length of vectorizer: ', len(vect.get_feature_names()))