Rozkládáme Transformer na části
Architektura Transformer zrevolučnila sekvenční modelování a integruje celou řadu pokroků v deep learningu – od pozičního kódování přes mechanismy pozornosti až po mnoho dalšího.
Která komponenta architektury Transformer je zodpovědná za zachycení informací o pozici každého tokenu v sekvenci?
Toto cvičení je součástí kurzu
Transformer Models with PyTorch
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení