or
Cette activité fait partie du cours
Apprenez l'essentiel du traitement de texte en Natural Language Processing (NLP). Maîtrisez des techniques comme la segmentation en jetons, la suppression des mots vides et de la ponctuation, ainsi que la normalisation du texte avec la mise en minuscules, le racinage (stemming) et la lemmatisation pour préparer les données textuelles à l'analyse et à l'extraction d'information.
Transformez du texte brut en caractéristiques numériques puissantes. Créez des représentations en sac de mots (Bag-of-Words) et en TF-IDF pour mesurer l'importance des mots à travers les documents, puis explorez des embeddings comme Word2Vec et GloVe pour révéler des relations sémantiques profondes. Visualisez la fréquence, la pertinence et la similarité pour donner vie à vos données textuelles.
Exercice en cours
Exploitez la puissance des modèles préentraînés pour réaliser des tâches avancées de classification de texte. Utilisez les pipelines Hugging Face pour l'analyse des sentiments, la classification thématique et l'inférence en langue naturelle. Évaluez la similarité sémantique et la correction grammaticale avec des modèles de pointe, le tout sans repartir de zéro.
Plongez au cœur des applications modernes du NLP avec la classification de jetons et les techniques de génération de texte. Apprenez à extraire des entités et des structures grammaticales pertinentes grâce à la reconnaissance d'entités nommées (NER) et à l'étiquetage PoS. Maîtrisez les approches de question-réponse extractive et abstractive, et explorez des tâches avancées de génération, dont le résumé automatique, la traduction et la modélisation de langue, en utilisant les pipelines Hugging Face.