始める無料で始める

カスタム Frozen Lake の MDP 構成要素

ここで扱うグリッドワールド環境は、エージェントが穴を避けながらゴールへ到達する Frozen Lake 環境のバリエーションです。あなたの課題は、この環境を分析し、いくつかの質問に答えることで MDP として定式化することです。

必要に応じて環境を目視で確認しても、事前に読み込まれている env 変数を使って調べてもかまいません。

この演習はコースの一部です

Pythonで学ぶGymnasiumによるReinforcement Learning

コースを見る

実践的なインタラクティブ演習

理論を実践に変える、インタラクティブな演習のひとつをお試しください

演習を開始する