《智能系统学报》 过刊查询页面

    关键词中包括 policy optimization 的文章

1 动态距离约束的离线到在线强化学习
赵若涵, 魏巍, 王达, 黄利 2026年4期 [1055-1065][摘要](11)[pdf 4053KB](12)
2 基于深度强化学习的室内视觉局部路径规划
朱少凯, 孟庆浩, 金晟, 戴旭阳 2022年5期 [908-918][摘要](6261)[pdf 5100KB](4437)