Passons en revue les méthodes n° 2
Dans cet exercice, vous allez passer en revue quatre méthodes supplémentaires.
e: Techniques de modélisation, dont LDA, utilisées pour regrouper des textes en ensembles ou types selon les mots similaires employés.f: Méthode permettant de parcourir un texte et d’annoter les mots qui identifient des personnes, des lieux ou des organisations.g: Méthode utilisée pour rechercher des motifs spécifiques dans un texte.h: Représenter les mots dans un espace vectoriel de grande dimension où les mots similaires sont proches les uns des autres dans cet espace.
Cet exercice fait partie du cours
<cours>Introduction au Natural Language Processing en R</cours>Instructions de l’exercice
- À partir des 4 descriptions ci‑dessus, associez chaque modèle ou méthode à la lettre correspondante.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Named Entity Recognition
NER <- ___
# Topic Modeling
TM <- ___
# Word Embeddings
WE <- ___
# Regular Expressions
REGEX <- ___