Minibatch e DRL
Nel contesto di PPO o A2C, a cosa si riferisce un minibatch?
Questo esercizio fa parte del corso
Deep Reinforcement Learning in Python
Esercizio pratico interattivo
Passa dalla teoria alla pratica con uno dei nostri esercizi interattivi
Inizia esercizio