DDQN में ऑनलाइन नेटवर्क और टारगेट नेटवर्क
Double DQN में, जैसे फिक्स्ड Q-targets वाले DQN में होता है, दो न्यूरल नेटवर्क काम करते हैं: ऑनलाइन नेटवर्क और टारगेट नेटवर्क। DDQN ट्रेनिंग लूप में इन दोनों के उद्देश्य और उनकी भूमिकाएँ समझना महत्वपूर्ण है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Deep Reinforcement Learning
इंटरैक्टिव व्यावहारिक अभ्यास
हमारे इंटरैक्टिव अभ्यासों में से किसी एक के साथ सिद्धांत को व्यवहार में बदलें
अभ्यास शुरू करें