Nastavení prostředí a neuronové sítě
Začneme nastavením prostředí, které budeš používat v celém kurzu: prostředí Lunar Lander, ve kterém agent ovládá trysky vozidla pokoušejícího se přistát na Měsíci.
torch, torch.nn, torch.optim a gym jsou v cvičeních již naimportovány.
Toto cvičení je součástí kurzu
Deep Reinforcement Learning v Pythonu
Pokyny k cvičení
- Inicializuj prostředí Lunar Lander v
gym(LunarLander-v2). - Definuj jednu vrstvu lineární transformace se vstupní dimenzí
dim_inputsa výstupní dimenzídim_outputs. - Vytvoř instanci neuronové sítě se vstupní dimenzí
8a výstupní dimenzí4. - Předej optimalizátoru Adam parametry sítě.
Interaktivní cvičení na vyzkoušení si v praxi
Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.
# Initiate the Lunar Lander environment
env = gym.____
class Network(nn.Module):
def __init__(self, dim_inputs, dim_outputs):
super(Network, self).__init__()
# Define a linear transformation layer
self.linear = ____
def forward(self, x):
return self.linear(x)
# Instantiate the network
network = ____
# Initialize the optimizer
optimizer = optim.Adam(____, lr=0.0001)
print("Network initialized as:\n", network)