国内刊号:31-1289/TP
国际刊号:1000-3428
发布日期:
作者:吴思凡, 杜煜, 徐世杰, 杨硕, 杜晨
单位:北京联合大学 a. 智慧城市学院;b. 机器人学院;c. 北京市信息服务工程重点实验室, 北京 100101
关键词:智能车,汇流,深度确定性策略梯度,深度Q网络,连续动作空间
基金:国家自然科学基金(91420202)。
采用离散动作空间描述速度变化的智能车汇流模型不能满足实际车流汇入场景的应用要求,而深度确定性策略梯度(DDPG)结合策略梯度和函数近似方法,采用与深度Q网络(DQN)相同的网络结构,并使用连续动作空间对问题进行描述,更适合描述智能车速度变化。为此,提出一种基于DDPG算法的智能车汇流模型,将汇流问题转化为序列决策问题进行求解。实验结果表明,与基于DQN的模型相比,该模型的收敛速度较快,稳定性和成功率较高,更适合智能车汇入车辆场景的应用。
来源:2020年第1期
《计算机工程》期刊编辑部