Explorarea spațiilor de stări și acțiuni
Mediul Cliff Walking presupune că un agent traversează o grilă de la punctul de start până la obiectiv, evitând să cadă de pe stâncă. Dacă jucătorul ajunge într-o locație de pe stâncă, revine la poziția de start. Jucătorul face mutări până când atinge obiectivul, moment în care episodul se încheie. Sarcina ta este să explorezi spațiile de stări și acțiuni ale acestui mediu.

Acest exercițiu face parte din cursul
Reinforcement Learning cu Gymnasium în Python
Instrucțiuni pentru exercițiu
- Creează o instanță a mediului Cliff Walking folosind ID-ul de mediu
CliffWalking. - Calculează dimensiunea spațiului de acțiuni și stocheaz-o în
num_actions. - Calculează dimensiunea spațiului de stări și stocheaz-o în
num_states.
Exercițiu interactiv practic
Încearcă acest exercițiu completând acest cod de exemplu.
# Create the Cliff Walking environment
env = ____
# Compute the size of the action space
num_actions = ____
# Compute the size of the state space
num_states = ____
print("Number of actions:", num_actions)
print("Number of states:", num_states)