เริ่มต้นใช้งานเริ่มต้นใช้งานได้ฟรี

Online network และ target network ใน DDQN

ใน Double DQN เช่นเดียวกับ DQN แบบ fixed Q-targets จะมีโครงข่ายประสาทเทียมสองตัวทำงานร่วมกัน ได้แก่ online network และ target network การเข้าใจบทบาทและหน้าที่ของแต่ละเครือข่ายในลูปการฝึก DDQN ถือเป็นสิ่งสำคัญ

แบบฝึกหัดนี้เป็นส่วนหนึ่งของหลักสูตร

Deep Reinforcement Learning ด้วย Python

ดูคอร์ส

แบบฝึกหัดเชิงโต้ตอบแบบลงมือทำจริง

เปลี่ยนทฤษฎีให้เป็นการลงมือทำด้วยแบบฝึกหัดเชิงโต้ตอบหนึ่งในของเรา

เริ่มแบบฝึกหัด