Bắt đầu ngayBắt đầu miễn phí

Mạng online và mạng target trong DDQN

Trong Double DQN, cũng như trong DQN với Q-target cố định, có hai mạng neural cùng hoạt động: mạng online và mạng target. Điều quan trọng là bạn cần hiểu mục đích riêng của từng mạng và vai trò của chúng trong vòng lặp huấn luyện DDQN.

Bài tập này là một phần của khóa học

Deep Reinforcement Learning bằng Python

Xem khóa học

Bài tập tương tác thực hành

Biến lý thuyết thành hành động với một trong các bài tập tương tác của chúng tôi

Bắt đầu bài tập