《智能系统学报》
过刊查询页面
关键词中包括
reinforcement learning
的文章
1
动态距离约束的离线到在线强化学习
赵若涵, 魏巍, 王达, 黄利 2026年4期 [1055-1065][
摘要
](
262
)
[
pdf
4053KB]
(
280
)
DOI:
10.11992/tis.202510017
2
面向复杂环境的机器人触觉感知算法研究综述
高春艳, 刘琦, 李满宏, 刘璇 2026年4期 [834-848][
摘要
](
313
)
[
pdf
5225KB]
(
298
)
DOI:
10.11992/tis.202510008
3
基于预测与强化学习的5G混合切片资源优化分配
陈智雄
1,2,3
, 谢宇鹏
1
, 郭以贺
1
2026年3期 [739-750][
摘要
](
314
)
[
pdf
7636KB]
(
413
)
DOI:
10.11992/tis.202506012
4
基于改进深度Q网络的智能网联汽车路径规划
文家燕
1,2
, 王怡博
1,2
, 辛华健
3
, 谢广明
4
2026年1期 [226-235][
摘要
](
1045
)
[
pdf
5120KB]
(
904
)
DOI:
10.11992/tis.202502010
5
基于深度行为评判策略的5G光伏基站低碳绿能方法
邓翠艳
1
, 齐小刚
2
2025年5期 [1198-1206][
摘要
](
1934
)
[
pdf
4352KB]
(
1586
)
DOI:
10.11992/tis.202501024
6
基于自适应分位数的离线强化学习算法
周娴玮, 王宇翔, 罗仕鑫, 余松森 2025年5期 [1093-1102][
摘要
](
2322
)
[
pdf
5131KB]
(
1796
)
DOI:
10.11992/tis.202410016
7
基于分层多智能体强化学习的多无人机视距内空战
雍宇晨
1,2
, 李子豫
3
, 董琦
2
2025年3期 [548-556][
摘要
](
2506
)
[
pdf
4608KB]
(
4652
)
DOI:
10.11992/tis.202408008
8
基于强化学习的超高层建筑非法入侵情景推演方法
胡今鸣
1
, 胡啸峰
1,2,3
, 石磊
4
, 石拓
5
, 滕腾
1
2025年4期 [958-968][
摘要
](
3296
)
[
pdf
5528KB]
(
2987
)
DOI:
10.11992/tis.202408002
9
基于人工势场的防疫机器人改进近端策略优化算法
伍锡如, 沈可扬 2025年3期 [689-698][
摘要
](
1834
)
[
pdf
4889KB]
(
2115
)
DOI:
10.11992/tis.202407026
10
基于改进DDQN船舶自动靠泊路径规划方法
李康斌, 朱齐丹, 牟进友, 菅紫婷 2025年1期 [73-80][
摘要
](
3128
)
[
pdf
4790KB]
(
3667
)
DOI:
10.11992/tis.202401005
11
数据中心冷热电联产系统的前摄式智能节能优化算法
李庆华
1
, 冉泳屹
1
, 刘启晨
2
, 孙彤瑶
1
, 陈双武
3
, 雒江涛
1
2025年1期 [139-149][
摘要
](
3011
)
[
pdf
5245KB]
(
3066
)
DOI:
10.11992/tis.202312037
12
基于强化学习与直接升力的舰载机自动着舰控制
王子博, 朱齐丹, 孔令鑫, 王立鹏 2025年2期 [416-424][
摘要
](
3115
)
[
pdf
4851KB]
(
7534
)
DOI:
10.11992/tis.202312026
13
基于深度强化学习的电力线与无线双模通信MAC层接入算法
陈智雄
1,2
, 詹学滋
1
, 左嘉烁
1
2025年2期 [344-354][
摘要
](
3074
)
[
pdf
4917KB]
(
3397
)
DOI:
10.11992/tis.202312023
14
洋流干扰下低速欠驱动AUV的三维路径规划
陈世同, 鲁子瑜 2025年2期 [425-434][
摘要
](
3086
)
[
pdf
17308KB]
(
8529
)
DOI:
10.11992/tis.202311004
15
基于数据质量评估的高效强化联邦学习节点动态采样优化
赵泽华, 梁美玉, 薛哲, 李昂, 张珉 2024年6期 [1552-1561][
摘要
](
2349
)
[
pdf
4047KB]
(
2353
)
DOI:
10.11992/tis.202305054
16
融合专家纠偏策略的移动机器人动态环境避障方法
田顺钰, 欧阳勇平, 魏长赟 2024年6期 [1492-1502][
摘要
](
2725
)
[
pdf
5668KB]
(
2322
)
DOI:
10.11992/tis.202304056
17
规则耦合下的多异构子网络MADDPG博弈对抗算法
张钰欣, 赵恩娇, 赵玉新 2024年1期 [190-208][
摘要
](
3300
)
[
pdf
11337KB]
(
3295
)
DOI:
10.11992/tis.202303037
18
麻将博弈AI构建方法综述
李霞丽
1,2
, 王昭琦
1,2
, 刘博
1,2
, 吴立成
1,2
2023年6期 [1143-1155][
摘要
](
6757
)
[
pdf
4563KB]
(
7355
)
DOI:
10.11992/tis.202211028
19
基于强化学习的水下高速航行体纵向运动控制研究
白涛, 董勤浩, 冯梓昆, 李雪华 2023年5期 [902-916][
摘要
](
3584
)
[
pdf
6231KB]
(
3436
)
DOI:
10.11992/tis.202203024
20
车辆多目标交互行为建模的轨迹预测方法
赵靖文, 李煊鹏, 张为公 2023年3期 [480-488][
摘要
](
4542
)
[
pdf
4476KB]
(
4358
)
DOI:
10.11992/tis.202201022
21
基于深度强化学习的动态装配算法
王竣禾
1,2,3
, 姜勇
1,2
2023年1期 [2-11][
摘要
](
4681
)
[
pdf
3362KB]
(
3586
)
DOI:
10.11992/tis.202201006
22
基于深度强化学习的节能工艺路线发现方法
陶鑫钰
1,2
, 王艳
1,2
, 纪志成
1,2
2023年1期 [23-35][
摘要
](
4096
)
[
pdf
5273KB]
(
3616
)
DOI:
10.11992/tis.202112030
23
场景图谱驱动目标搜索的多智能体强化学习
陆升阳
1
, 赵怀林
1
, 刘华平
2
2023年1期 [207-215][
摘要
](
4333
)
[
pdf
4586KB]
(
3833
)
DOI:
10.11992/tis.202111034
24
基于深度强化学习的室内视觉局部路径规划
朱少凯, 孟庆浩, 金晟, 戴旭阳 2022年5期 [908-918][
摘要
](
6407
)
[
pdf
5100KB]
(
4521
)
DOI:
10.11992/tis.202107059
25
旋翼无人机在移动平台降落的控制参数自学习调节方法
张鹏鹏, 魏长赟, 张恺睿, 欧阳勇平 2022年5期 [931-940][
摘要
](
4187
)
[
pdf
5359KB]
(
3980
)
DOI:
10.11992/tis.202107040
26
动态环境下分布式异构多机器人避障方法研究
欧阳勇平
1
, 魏长赟
1
, 蔡帛良
1,2
2022年4期 [752-763][
摘要
](
4735
)
[
pdf
8570KB]
(
3821
)
DOI:
10.11992/tis.202106044
27
基于强化学习的海洋移动观测网络观测路径规划方法
赵玉新
1
, 杜登辉
1
, 成小会
1
, 周迪
2
, 邓雄
1
, 刘延龙
1
2022年1期 [192-200][
摘要
](
7569
)
[
pdf
5755KB]
(
4225
)
DOI:
10.11992/tis.202106004
28
基于强化学习的参数自整定及优化算法
严家政
1
, 专祥涛
1,2
2022年2期 [341-347][
摘要
](
6674
)
[
pdf
3881KB]
(
3921
)
DOI:
10.11992/tis.202012038
29
强化学习稀疏奖励算法研究——理论与实验
杨瑞
1
, 严江鹏
1
, 李秀
1,2
2020年5期 [888-899][
摘要
](
9093
)
[
pdf
4915KB]
(
4962
)
DOI:
10.11992/tis.202003031
30
记忆神经网络在机器人导航领域的应用与研究进展
王作为
1,2
, 徐征
3,4
, 张汝波
5
, 洪才森
1
, 王殊
1
2020年5期 [835-846][
摘要
](
9572
)
[
pdf
4964KB]
(
6546
)
DOI:
10.11992/tis.202002020
31
基于注意力融合的图像描述生成方法
莫宏伟, 田朋 2020年4期 [740-749][
摘要
](
8458
)
[
pdf
3533KB]
(
4485
)
DOI:
10.11992/tis.201910039
32
多智能体分层强化学习综述
殷昌盛, 杨若鹏, 朱巍, 邹小飞, 李峰 2020年4期 [646-655][
摘要
](
13537
)
[
pdf
4674KB]
(
8188
)
DOI:
10.11992/tis.201909027
33
仿生机器人运动步态控制:强化学习方法综述
郭宪, 方勇纯 2020年1期 [152-159][
摘要
](
8050
)
[
pdf
2932KB]
(
5981
)
DOI:
10.11992/tis.201907052
34
深度强化学习中状态注意力机制的研究
申翔翔
1
, 侯新文
2
, 尹传环
1
2020年2期 [317-322][
摘要
](
8626
)
[
pdf
4039KB]
(
4845
)
DOI:
10.11992/tis.201809033
35
事件驱动的强化学习多智能体编队控制
徐鹏
1
, 谢广明
1,2,3
, 文家燕
1,2
, 高远
1
2019年1期 [93-98][
摘要
](
9084
)
[
pdf
4457KB]
(
4844
)
DOI:
10.11992/tis.201807010
36
分层强化学习综述
周文吉, 俞扬 2017年5期 [590-594][
摘要
](
20088
)
[
pdf
906KB]
(
17419
)
DOI:
10.11992/tis.201706031
37
基于事件驱动的多智能体强化学习研究
张文旭, 马磊, 王晓东 2017年1期 [82-87][
摘要
](
9414
)
[
pdf
1289KB]
(
6256
)
DOI:
10.11992/tis.201604008
38
基于强化学习的多定位组件自动选择方法
梁爽
1
, 曹其新
1
, 王雯珊
1
, 邹风山
2
2016年2期 [149-154][
摘要
](
7709
)
[
pdf
1456KB]
(
5401
)
DOI:
10.11992/tis.201510031
39
面向资源分配问题的Q-CF多智能体强化学习
连传强,徐昕,吴军,李兆斌 2011年2期 [95-100][
摘要
](
7168
)
[
pdf
551KB]
(
5193
)
DOI:
40
回报函数学习的学徒学习综述
金卓军,钱? 徽,陈沈轶,朱淼良 2009年3期 [208-212][
摘要
](
7766
)
[
pdf
310KB]
(
6637
)
DOI:
41
一种逻辑强化学习的tableau推理方法
刘 全
1, 2
,崔志明
1
,高 阳
2
,陈道蓄
2
,姚望舒
1
2008年4期 [355-360][
摘要
](
8092
)
[
pdf
454KB]
(
6868
)
DOI:
42
增强学习中的直接策略搜索方法综述
王学宁
1
, 陈 伟
1
, 张 锰
2
, 徐 昕
1
,? 贺汉根
1
2007年1期 [16-24][
摘要
](
13129
)
[
pdf
504KB]
(
15323
)
DOI:
43
基于多智能体的Option自动生成算法
沈 晶, 顾国昌, 刘海波 2006年1期 [84-87][
摘要
](
6911
)
[
pdf
342KB]
(
6378
)
DOI: