《智能系统学报》
过刊查询页面
关键词中包括
policy optimization
的文章
1
动态距离约束的离线到在线强化学习
赵若涵, 魏巍, 王达, 黄利 2026年4期 [1055-1065][
摘要
](
11
)
[
pdf
4053KB]
(
12
)
DOI:
10.11992/tis.202510017
2
基于深度强化学习的室内视觉局部路径规划
朱少凯, 孟庆浩, 金晟, 戴旭阳 2022年5期 [908-918][
摘要
](
6261
)
[
pdf
5100KB]
(
4437
)
DOI:
10.11992/tis.202107059