Online network และ target network ใน DDQN
ใน Double DQN เช่นเดียวกับ DQN แบบ fixed Q-targets จะมีโครงข่ายประสาทเทียมสองตัวทำงานร่วมกัน ได้แก่ online network และ target network การเข้าใจบทบาทและหน้าที่ของแต่ละเครือข่ายในลูปการฝึก DDQN ถือเป็นสิ่งสำคัญ
แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร
Deep Reinforcement Learning ด้วย Python
แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง
เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา
เริ่มแบบฝึกหัด