Mạng online và mạng target trong DDQN
Trong Double DQN, cũng như trong DQN với Q-target cố định, có hai mạng neural cùng hoạt động: mạng online và mạng target. Điều quan trọng là bạn cần hiểu mục đích riêng của từng mạng và vai trò của chúng trong vòng lặp huấn luyện DDQN.
Bài tập này là một phần của khóa học
Deep Reinforcement Learning bằng Python
Bài tập tương tác thực hành
Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi
Bắt đầu bài tập