Rețeaua online și rețeaua țintă în DDQN
În Double DQN, ca și în DQN cu Q-ținte fixe, există două rețele neuronale implicate: rețeaua online și rețeaua țintă. Este important să înțelegi rolul fiecăreia și modul în care contribuie la bucla de antrenament DDQN.
Acest exercițiu face parte din cursul
Deep Reinforcement Learning în Python
Exercițiu interactiv practic
Transformă teoria în practică cu unul dintre exercițiile noastre interactive
Începe exercițiul