Deep Q Network(深度Q网络, DQN)同时采用两个结构一致、参数不同的卷积神经网络,其中一个网络用来选择动作,并更新模型参数,此网络称为评估网络;另一个网络用于计算目标Q值,此网络称为 。
A、深度网络
B、评价网络
C、目标网络
D、反馈网络