Začněte nyníZačněte zdarma

Nastavení prostředí a neuronové sítě

Začneme nastavením prostředí, které budeš používat v celém kurzu: prostředí Lunar Lander, ve kterém agent ovládá trysky vozidla pokoušejícího se přistát na Měsíci.

torch, torch.nn, torch.optim a gym jsou v cvičeních již naimportovány.

Toto cvičení je součástí kurzu

Deep Reinforcement Learning v Pythonu

Zobrazit kurz

Pokyny k cvičení

  • Inicializuj prostředí Lunar Lander v gym (LunarLander-v2).
  • Definuj jednu vrstvu lineární transformace se vstupní dimenzí dim_inputs a výstupní dimenzí dim_outputs.
  • Vytvoř instanci neuronové sítě se vstupní dimenzí 8 a výstupní dimenzí 4.
  • Předej optimalizátoru Adam parametry sítě.

Interaktivní cvičení na vyzkoušení si v praxi

Vyzkoušejte si toto cvičení dokončením tohoto ukázkového kódu.

# Initiate the Lunar Lander environment
env = gym.____

class Network(nn.Module):
    def __init__(self, dim_inputs, dim_outputs):
        super(Network, self).__init__()
        # Define a linear transformation layer 
        self.linear = ____
    def forward(self, x):
        return self.linear(x)

# Instantiate the network
network = ____

# Initialize the optimizer
optimizer = optim.Adam(____, lr=0.0001)

print("Network initialized as:\n", network)
Upravit a spustit kód