Komponenty vlastního MDP Frozen Lake
Toto prostředí mřížkového světa je variací prostředí Frozen Lake, kde se agent musí dostat k cíli a přitom se vyhýbat dírám. Tvým úkolem je toto prostředí analyzovat a popsat ho jako MDP zodpovězením několika otázek.
Odpovědi můžeš zjistit vizuální inspekcí prostředí, kde to přichází v úvahu, nebo pomocí předpřipravené proměnné env.
Toto cvičení je součástí kurzu
Reinforcement Learning with Gymnasium in Python
Interaktivní praktické cvičení
Proměňte teorii v praxi s jedním z našich interaktivních cvičení
Začít cvičení