Révision des méthodes nº 2
Dans cet exercice, vous allez passer en revue quatre méthodes supplémentaires.
e: Techniques de modélisation, dont LDA, utilisées pour regrouper des textes en ensembles ou en types selon la similarité des mots employés.f: Méthode qui parcourt le texte et étiquette les mots qui identifient des personnes, des lieux ou des organisations.g: Méthode utilisée pour chercher dans le texte des motifs précis.h: Représentation des mots dans un espace vectoriel de grande dimension où les mots similaires sont rapprochés les uns des autres.
Cette activité fait partie du cours
Introduction au traitement automatique des langues en R
Instructions de l’exercice
- En vous basant sur les 4 descriptions ci‑dessus, assignez à chaque modèle ou méthode la lettre correspondante.
Exercice interactif pratique
Essayez cet exercice en complétant ce code d’exemple.
# Named Entity Recognition
NER <- ___
# Topic Modeling
TM <- ___
# Word Embeddings
WE <- ___
# Regular Expressions
REGEX <- ___