始める無料で始める

DDQN におけるオンラインネットワークとターゲットネットワーク

Double DQN では、固定 Q ターゲットを用いる DQN と同様に、オンラインネットワークとターゲットネットワークという 2 つのニューラルネットワークを使います。DDQN の学習ループにおいて、それぞれの目的と役割を正しく理解することが大切です。

この演習はコースの一部です

Pythonで学ぶDeep Reinforcement Learning

コースを見る

実践的なインタラクティブ演習

理論を実践に変える、インタラクティブな演習のひとつをお試しください

演習を開始する