Episodic और Continuous RL टास्क्स
RL में टास्क्स को दो मुख्य प्रकारों में बाँटा जा सकता है: episodic और continuous. इन दोनों के बीच अंतर समझना उपयुक्त RL एल्गोरिदम डिज़ाइन करने के लिए बेहद ज़रूरी है.
यह अभ्यास पाठ्यक्रम का हिस्सा है
Python में Gymnasium के साथ Reinforcement Learning
इंटरैक्टिव व्यावहारिक अभ्यास
हमारे इंटरैक्टिव अभ्यासों में से किसी एक के साथ सिद्धांत को व्यवहार में बदलें
अभ्यास शुरू करें