Eksploracja przestrzeni stanów i akcji
Środowisko Cliff Walking polega na tym, że agent przemieszcza się po siatce od punktu startowego do celu, unikając spadnięcia ze skały. Jeśli gracz trafi na pole ze skałą, wraca do punktu startowego. Gra toczy się do momentu, gdy gracz osiągnie cel – wtedy epizod się kończy. Twoim zadaniem jest zbadanie przestrzeni stanów i akcji tego środowiska.

To ćwiczenie jest częścią kursu
Uczenie przez wzmacnianie z Gymnasium w Pythonie
Instrukcje do ćwiczenia
- Utwórz instancję środowiska Cliff Walking, używając identyfikatora
CliffWalking. - Oblicz rozmiar przestrzeni akcji i zapisz wynik w zmiennej
num_actions. - Oblicz rozmiar przestrzeni stanów i zapisz wynik w zmiennej
num_states.
Interaktywne ćwiczenie praktyczne
Spróbuj tego ćwiczenia, uzupełniając ten przykładowy kod.
# Create the Cliff Walking environment
env = ____
# Compute the size of the action space
num_actions = ____
# Compute the size of the state space
num_states = ____
print("Number of actions:", num_actions)
print("Number of states:", num_states)