

系统工程与电子技术 ›› 2026, Vol. 48 ›› Issue (9): 3167-3178.doi: 10.12305/j.issn.1001-506X.2026.09.29
• 制导、导航与控制 • 上一篇
收稿日期:2025-06-13
修回日期:2025-08-09
出版日期:2025-11-25
发布日期:2025-11-25
通讯作者:
盛永智
E-mail:shengyongzhi@bit.edu.cn
作者简介:张倬境(2001—),男,硕士研究生,主要研究方向为飞行器制导与控制、深度强化学习
Zhuojing Zhang, Yongzhi Sheng(
), Xiaolong Gong
Received:2025-06-13
Revised:2025-08-09
Online:2025-11-25
Published:2025-11-25
Contact:
Yongzhi Sheng
E-mail:shengyongzhi@bit.edu.cn
摘要:
针对高超声速拦截弹末端制导存在的攻击角、视场角等多约束难题,提出深度强化学习驱动的多约束分数阶滑模制导律。改进双延迟深度确定性策略梯度算法,引入多头注意力机制作为特征提取层,实现环境状态多尺度特征融合,利用长短期记忆网络增强时序特征理解,通过自适应探索与回合制训练优化框架提升算法收敛性与稳定性。基于弹目三维相对运动学模型,构建含攻击角约束的分数阶滑模基础制导律框架,通过改进强化学习算法动态优化制导参数,解决多约束下精确制导问题。仿真结果表明,所提制导律在满足多种角度约束条件下可显著提升制导速度与精度,验证了所提方法的正确性与有效性。
中图分类号:
张倬境, 盛永智, 龚孝龙. 深度强化学习驱动的多约束分数阶滑模制导律[J]. 系统工程与电子技术, 2026, 48(9): 3167-3178.
Zhuojing Zhang, Yongzhi Sheng, Xiaolong Gong. Deep reinforcement learning-driven multi-constraint fractional order sliding mode guidance law[J]. Systems Engineering and Electronics, 2026, 48(9): 3167-3178.
表2
设定场景的初始参数"
| 初始参数 | 数值 |
| 导弹初始位置 | (0,22,0) |
| 目标初始位置 | (30,30,5) |
| 导弹初始速度大小 | |
| 导弹初始弹道倾角 | 0 |
| 导弹驾驶仪自然震荡频率 | 6.663 |
| 导弹驾驶仪阻尼比 | 0.707 |
| 导弹初始弹道偏角 | 0 |
| 目标初始速度大小 | |
| 目标初始弹道倾角 | −10 |
| 目标初始弹道偏角 | 10 |
| 视场角约束 | 38 |
| 末端攻击角高低角约束/(°) | 10 |
| 末端攻击角方位角约束/(°) | 10 |
| 1 | Ryoo C K, Cho H J, Tank M J. Optimal guidance laws with terminal impact angle constraint[J]. Journal of Guidance, Control, and Dynamics, 2005, 28 (4): 724. |
| 2 |
席杰, 杨军, 朱学平. 带落角和导引头视角约束的制导律设计[J]. 电光与控制, 2014, 21 (9): 26.
doi: 10.3969/j.issn.1671-637X.2014.09.006 |
| 3 | Han T, Zhang S X, Hu Q L, et al. Field-of-view reduced impact angle guidance law via range shaping approach[J]. IEEE Trans. on Aerospace and Electronic Systems, 2025, accepted. |
| 4 | 熊少锋, 魏明英, 赵明元, 等. 逆轨拦截机动目标的三维最优制导律[J]. 宇航学报, 2020, 41 (1): 80. |
| 5 | 吴盘龙, 王勇, 钟俊, 等. 拦截机动目标的多约束下协同制导律[J]. 中国惯性技术学报, 2023, 31 (11): 1142. |
| 6 | Xiong T H, Wang C Y, Zhang K, et al. Design of three-dimensional vector guidance law for attack time and angle under field of view angle constraints[J]. Aero Weaponry, 2024, 31 (4): 49. |
| 7 | 王鹏, 陈万春, 陈中原. 视场约束下攻击角度及时间控制三维协同制导[J]. 战术导弹技术, 2022 (4): 30. |
| 8 |
Kang H L, Wang P, Song S, et al. Prescribed-time three-dimensional guidance for maneuvering targets with field-of-view and approach angle constraints[J]. IEEE Trans. on Aerospace and Electronic Systems, 2025, 61 (3): 5996.
doi: 10.1109/TAES.2024.3523884 |
| 9 |
Zhang L, Yi W J, Guan J. Nonsingular sliding mode guidance law for impact time control with field-of-view constraint[J]. IEEE Access, 2025, 13, 32004.
doi: 10.1109/ACCESS.2025.3531042 |
| 10 | Zhao B, Xiang T Y. Three-dimensional guidance law with terminal angle constraint based on multivariable super-twisting sliding mode[J]. Control and Decision, 2024, 39 (11): 3577. |
| 11 |
Zhao Y, Sheng Y Z, Liu X D. Sliding modecontrol based guidance law with impact angle constraint[J]. Chinese Journal of Aeronautics, 2014, 27 (1): 145.
doi: 10.1016/j.cja.2013.12.011 |
| 12 |
Hang Y, Dai K R, Li H J, et al. Three dimensional adaptive fixed-time cooperative guidance law with impact time and angle constraints.[J]. Aerospace Science and Technology, 2022, 123, 107450.
doi: 10.1016/j.ast.2022.107450 |
| 13 |
Ming C, Wang X M, Sun R. A novel non-singular terminal sliding mode control based integrated missile guidance and control with impact angle constraint[J]. Aerospace Science and Technology, 2019, 94, 105368.
doi: 10.1016/j.ast.2019.105368 |
| 14 |
唐骁, 叶继坤. 针对高速机动目标的分数阶滑模制导律[J]. 航空兵器, 2021, 28 (2): 21.
doi: 10.12132/ISSN.1673-5048.2020.0183 |
| 15 |
Sheng Y Z, Zhang Z, Xia L. Fractional-order sliding mode control based guidance law with impact angle constraint[J]. Nonlinear Dynamics, 2021, 106 (1): 425.
doi: 10.1007/s11071-021-06820-6 |
| 16 | 盛永智, 甘佳豪, 张成新. 弹道可调的落角约束分数阶滑模制导律设计[J]. 航空学报, 2023, 44 (7): 182. |
| 17 |
Zhang Z Q, Yin Z J, Meng W L, et al. Sliding-mode guidance law with field-of-view constraint and impact time control for missiles[J]. Journal of Physics: Conference Series, 2025, 2955, 012029.
doi: 10.1088/1742-6596/2955/1/012029 |
| 18 |
康冰冰, 姜涛, 曹建, 等. 基于强化学习的带落角约束的制导律研究[J]. 航空兵器, 2023, 30 (6): 44.
doi: 10.12132/ISSN.1673-5048.2023.0062 |
| 19 | 苏杰, 王康, 曾鑫, 等. 基于深度强化学习的落角和视场角约束制导律[J]. 兵工学报, 2025, 46 (4): 257. |
| 20 | 张青龙, 赵斌, 许新鹏. 被动探测视场角约束下的深度强化学习制导方法[J]. 宇航学报, 2024, 45 (8): 1281. |
| 21 | 惠俊鹏, 汪韧, 郭继峰. 基于强化学习的禁飞区绕飞智能制导技术[J]. 航空学报, 2023, 44 (11): 240. |
| 22 |
Deng T B, Huang H, Fang Y W, et al. Rein-forcement learning based missile terminal guidance of maneuvering targets with decoys[J]. Chinese Journal of Aeronautics, 2023, 36 (12): 309.
doi: 10.1016/j.cja.2023.05.028 |
| 23 |
Gao Y, Zhou R, Chen J Y. Integrated entry guidance with no-fly zone constraint using reinforcement learning and predictor-corrector technique[J]. Proceedings of the Institution of Mechanical Engineers, Part G: Journal of Aerospace Engineering, 2024, 238 (7): 728.
doi: 10.1177/09544100241236995 |
| 24 | 陈文雪, 高长生, 荆武兴. 拦截机动目标的信赖域策略优化制导算法[J]. 航空学报, 2023, 44 (11): 282. |
| 25 | 邱潇颀, 高长生, 荆武兴. 拦截大气层内机动目标的深度强化学习制导律[J]. 宇航学报, 2022, 43 (5): 685. |
| 26 |
Gaudet B, Furfaro R, Linares R. Reinforcement learning for angle-only intercept guidance of maneuvering targets[J]. Aerospace Science and Technology, 2020, 99, 105746.
doi: 10.1016/j.ast.2020.105746 |
| 27 | Lee S, Lee Y, Kim Y, et al. Impact angle control guidance considering seeker’s field-of-view limit based on reinforcement learning[J]. Journal of Guidance, Control, and Dynamics, 2023, 46 (11): 2168. |
| 28 | 李博皓, 安旭曼, 杨晓飞, 等. 攻击角度约束下的分布式强化学习制导方法[J]. 宇航学报, 2022, 43 (8): 1061. |
| 29 |
Gong X P, Chen W C, Chen Z Y. All-aspect attack guidance law for agile missiles based on deep reinforcement learning[J]. Aerospace Science and Technology, 2022, 127, 107677.
doi: 10.1016/j.ast.2022.107677 |
| 30 |
Ai X L, Wang L L, Yu J Q, et al. Field-of-view constrained two-stage guidance law design for three-dimensional salvo attack of multiple missiles via an optimal control approach[J]. Aerospace Science and Technology, 2019, 85, 334.
doi: 10.1016/j.ast.2018.11.052 |
| 31 |
Li Z B, Dong Q L, Zhang X Y, et al. Impact angle-constrained integrated guidance and control for supersonic skid-to-turn missiles using backstepping with global fast terminal sliding mode control[J]. Aerospace Science and Technology, 2022, 122, 107386.
doi: 10.1016/j.ast.2022.107386 |
| 32 | Trigeassou J C, Maamri N, Sabatier J, et al. A Lyapunov approach to the stability of fractional differential equations[J]. Signal Processing, 2010, 91 (3): 437. |
| 33 | Chang G N, Wang Y, Chen Y, et al. Guidance law design for ballistic forming with multiple constraints[J]. Journal of Projectiles, Rockets, Missiles and Guidance, 2015 (5): 33. |
| 34 | 尤浩, 常新龙, 赵久奋, 等. 带角度约束的三维积分二阶滑模拦截制导律[J]. 宇航学报, 2024, 45 (4): 590. |
| 35 | 张书森, 孟秀云, 丁晓. 一种带终端视线角约束的反舰导弹三维协同制导律[J]. 火力与指挥控制, 2023, 48 (6): 84. |
| [1] | 赵立阳, 吴金平, 杨静, 张瑞. 基于深度强化学习的多智能体集中式作战行动指挥决策方法[J]. 系统工程与电子技术, 2026, 48(9): 3089-3103. |
| [2] | 张杰, 朱峰, 王超, 李东, 陈志群, 吕天启. 逻辑链构建下基于深度强化学习的多智能体协同算法优化[J]. 系统工程与电子技术, 2026, 48(9): 3126-3135. |
| [3] | 马赞, 刘禹彬, 白杰, 陈勇, 孙淑光. 基于分层STPA-MC的无人机智能避让适航安全风险评估[J]. 系统工程与电子技术, 2026, 48(6): 2000-2013. |
| [4] | 贾振帅, 肖冰, 钱寒雨, 张哲宇. 基于多策略学习的航天器在轨观测机动决策方法[J]. 系统工程与电子技术, 2026, 48(5): 1590-1598. |
| [5] | 王旭, 蔡光斌, 余晓亚, 叶子绮, 单斌. 基于双动态PPO算法的高超声速飞行器姿态控制[J]. 系统工程与电子技术, 2026, 48(2): 694-704. |
| [6] | 薛锦妍, 张雅声, 陶雪峰, 杨茗棋, 赵帅龙. GEO航天器轨道机动控制研究进展[J]. 系统工程与电子技术, 2026, 48(1): 290-300. |
| [7] | 宋传龙, 张倩武, 何健, 周文骏, 王辉, 孔巍巍, 田文波. 基于MADDPG算法的星地协同边缘计算任务卸载方法[J]. 系统工程与电子技术, 2026, 48(1): 350-360. |
| [8] | 魏潇龙, 吴亚荣, 姚登凯, 赵顾颢. 基于深度强化学习的无人机空战机动分层决策算法[J]. 系统工程与电子技术, 2025, 47(9): 2993-3003. |
| [9] | 朱运豆, 孙海权, 胡笑旋. 基于指针网络架构的多星协同成像任务规划方法[J]. 系统工程与电子技术, 2025, 47(7): 2246-2255. |
| [10] | 孟麟芝, 孙小涓, 胡玉新, 高斌, 孙国庆, 牟文浩. 面向卫星在轨处理的强化学习任务调度算法[J]. 系统工程与电子技术, 2025, 47(6): 1917-1929. |
| [11] | 郑康洁, 张新宇, 王伟菘, 刘震生. DQN与规则结合的智能船舶动态自主避障决策[J]. 系统工程与电子技术, 2025, 47(6): 1994-2001. |
| [12] | 刘书含, 李彤, 李富强, 杨春刚. 意图态势双驱动的数据链抗干扰通信机制[J]. 系统工程与电子技术, 2025, 47(6): 2055-2064. |
| [13] | 赵在强, 杨召, 杨添琦. 基于目标分配的多弹协同分层拦截制导策略[J]. 系统工程与电子技术, 2025, 47(5): 1671-1679. |
| [14] | 熊威, 张栋, 任智, 杨书恒. 面向有人/无人机协同打击的智能决策方法研究[J]. 系统工程与电子技术, 2025, 47(4): 1285-1299. |
| [15] | 马鹏, 蒋睿, 王斌, 徐盟飞, 侯长波. 基于隐式对手建模的策略重构抗智能干扰方法[J]. 系统工程与电子技术, 2025, 47(4): 1355-1363. |
| 阅读次数 | ||||||
|
全文 |
|
|||||
|
摘要 |
|
|||||