《智能系统学报》 过刊查询页面

    关键词中包括 reinforcement learning 的文章

1 基于强化学习的水下高速航行体纵向运动控制研究
白涛, 董勤浩, 冯梓昆, 李雪华 2023年5期 [902-916][摘要](209)[pdf 6231KB](76)
2 车辆多目标交互行为建模的轨迹预测方法
赵靖文, 李煊鹏, 张为公 2023年3期 [480-488][摘要](640)[pdf 4476KB](504)
3 基于深度强化学习的动态装配算法
王竣禾1,2,3, 姜勇1,2 2023年1期 [2-11][摘要](1029)[pdf 3362KB](726)
4 基于深度强化学习的节能工艺路线发现方法
陶鑫钰1,2, 王艳1,2, 纪志成1,2 2023年1期 [23-35][摘要](1013)[pdf 5273KB](678)
5 场景图谱驱动目标搜索的多智能体强化学习
陆升阳1, 赵怀林1, 刘华平2 2023年1期 [207-215][摘要](1022)[pdf 4586KB](675)
6 基于深度强化学习的室内视觉局部路径规划
朱少凯, 孟庆浩, 金晟, 戴旭阳 2022年5期 [908-918][摘要](1470)[pdf 5100KB](957)
7 旋翼无人机在移动平台降落的控制参数自学习调节方法
张鹏鹏, 魏长赟, 张恺睿, 欧阳勇平 2022年5期 [931-940][摘要](1204)[pdf 5359KB](787)
8 动态环境下分布式异构多机器人避障方法研究
欧阳勇平1, 魏长赟1, 蔡帛良1,2 2022年4期 [752-763][摘要](1568)[pdf 8570KB](808)
9 基于强化学习的海洋移动观测网络观测路径规划方法
赵玉新1, 杜登辉1, 成小会1, 周迪2, 邓雄1, 刘延龙1 2022年1期 [192-200][摘要](3788)[pdf 5755KB](1141)
10 基于强化学习的参数自整定及优化算法
严家政1, 专祥涛1,2 2022年2期 [341-347][摘要](3289)[pdf 3881KB](1049)
11 强化学习稀疏奖励算法研究——理论与实验
杨瑞1, 严江鹏1, 李秀1,2 2020年5期 [888-899][摘要](4574)[pdf 4915KB](1558)
12 记忆神经网络在机器人导航领域的应用与研究进展
王作为1,2, 徐征3,4, 张汝波5, 洪才森1, 王殊1 2020年5期 [835-846][摘要](5527)[pdf 4964KB](2680)
13 基于注意力融合的图像描述生成方法
莫宏伟, 田朋 2020年4期 [740-749][摘要](4892)[pdf 3533KB](1522)
14 多智能体分层强化学习综述
殷昌盛, 杨若鹏, 朱巍, 邹小飞, 李峰 2020年4期 [646-655][摘要](6873)[pdf 4674KB](2805)
15 仿生机器人运动步态控制:强化学习方法综述
郭宪, 方勇纯 2020年1期 [152-159][摘要](4852)[pdf 2932KB](1839)
16 深度强化学习中状态注意力机制的研究
申翔翔1, 侯新文2, 尹传环1 2020年2期 [317-322][摘要](4845)[pdf 4039KB](1726)
17 事件驱动的强化学习多智能体编队控制
徐鹏1, 谢广明1,2,3, 文家燕1,2, 高远1 2019年1期 [93-98][摘要](5568)[pdf 4457KB](1764)
18 分层强化学习综述
周文吉, 俞扬 2017年5期 [590-594][摘要](10683)[pdf 906KB](7742)
19 基于事件驱动的多智能体强化学习研究
张文旭, 马磊, 王晓东 2017年1期 [82-87][摘要](5840)[pdf 1289KB](2611)
20 基于强化学习的多定位组件自动选择方法
梁爽1, 曹其新1, 王雯珊1, 邹风山2 2016年2期 [149-154][摘要](4974)[pdf 1456KB](1996)
21 面向资源分配问题的Q-CF多智能体强化学习
连传强,徐昕,吴军,李兆斌 2011年2期 [95-100][摘要](4379)[pdf 551KB](2012)
DOI:
22 回报函数学习的学徒学习综述
金卓军,钱? 徽,陈沈轶,朱淼良 2009年3期 [208-212][摘要](4691)[pdf 310KB](3133)
DOI:
23 一种逻辑强化学习的tableau推理方法
刘 全1, 2 ,崔志明1 ,高 阳2 ,陈道蓄2 ,姚望舒1 2008年4期 [355-360][摘要](4107)[pdf 454KB](3346)
DOI:
24 增强学习中的直接策略搜索方法综述
王学宁1, 陈 伟1, 张 锰2, 徐 昕1,? 贺汉根1 2007年1期 [16-24][摘要](5933)[pdf 504KB](6191)
DOI:
25 基于多智能体的Option自动生成算法
沈 晶, 顾国昌, 刘海波 2006年1期 [84-87][摘要](4360)[pdf 342KB](3250)
DOI: