CommencezCommencez gratuitement

Décortiquer le Transformer

L'architecture Transformer a révolutionné la modélisation de séquences en intégrant de nombreuses avancées en deep learning, comme le codage positionnel, les mécanismes d'attention, et bien plus encore.


Quel composant de l'architecture Transformer est responsable de capter l'information sur la position de chaque jeton dans la séquence?

Cette activité fait partie du cours

Modèles Transformer avec PyTorch

Voir le cours

Exercice interactif pratique

Passez de la théorie à l’action grâce à l’un de nos exercices interactifs

Commencer l’exercice