dueling_dqn,doule_dqn,dqn强化学习模型交互
2023-06-12 13:40:08
9
举报
dueling_dqn,doule_dqn,dqn强化学习模型交互。
reward
a
R2
done
batch
R1
s
n_s
r
........................
action
②
①
next_state
target_model
agent
d
state
Exp Pool
Rn
③
train
environment
update model
pre_model