ÎncepețiÎncepe gratuit

Explorarea spațiilor de stări și acțiuni

Mediul Cliff Walking presupune că un agent traversează o grilă de la punctul de start până la obiectiv, evitând să cadă de pe stâncă. Dacă jucătorul ajunge într-o locație de pe stâncă, revine la poziția de start. Jucătorul face mutări până când atinge obiectivul, moment în care episodul se încheie. Sarcina ta este să explorezi spațiile de stări și acțiuni ale acestui mediu.

Image showing an animation for the cliff walking environment.

Acest exercițiu face parte din cursul

Reinforcement Learning cu Gymnasium în Python

Vezi cursul

Instrucțiuni pentru exercițiu

  • Creează o instanță a mediului Cliff Walking folosind ID-ul de mediu CliffWalking.
  • Calculează dimensiunea spațiului de acțiuni și stocheaz-o în num_actions.
  • Calculează dimensiunea spațiului de stări și stocheaz-o în num_states.

Exercițiu interactiv practic

Încearcă acest exercițiu completând acest cod de exemplu.

# Create the Cliff Walking environment
env = ____

# Compute the size of the action space
num_actions = ____

# Compute the size of the state space
num_states = ____

print("Number of actions:", num_actions)
print("Number of states:", num_states)
Editează și rulează codul