基于物理约束模仿学习的行星动力下降段智能控制OA
针对行星探测器动力下降段在多约束条件下推力指令实时生成的需求,以及星载计算资源受限而产生的低时延要求,提出一种基于物理约束模仿学习的智能控制方法。该方法以动力下降阶段滑动时间窗内的状态为输入,通过特征归一化与推力反归一化实现数据一致性,采用一维卷积网络提取短时序动态特征并输出推力指令。为确保推力预测的物理可行性并满足轨迹约束,在训练过程中引入物理约束损失:利用可微动力学使得推力预测与轨迹演化显式耦合,并以软惩罚形式对滑翔斜坡走廊约束与推力幅值可行域进行编码,从而在训练阶段直接融入几何可行性与执行机构可实现性。相较于纯数据回归的行为克隆方法,该策略可有效抑制分布外样本引发的不可行的动作输出,提升策略鲁棒性与工程可用性。结果表明,所提方法在保证软着陆精度与鲁棒性的同时显著降低在线计算负担,适合算力受限的星载平台实时应用。
肖以正;李波;梅杰;龚有敏;马广富
哈尔滨工业大学(深圳)空天科技学院,深圳518055哈尔滨工业大学(深圳)智能科学与工程学院,深圳518055哈尔滨工业大学(深圳)智能科学与工程学院,深圳518055哈尔滨工业大学(深圳)智能科学与工程学院,深圳518055哈尔滨工业大学(深圳)智能科学与工程学院,深圳518055
航空航天
行星着陆动力下降段计算资源受限模仿学习推力预测控制物理约束损失
《飞控与探测》 2026 (3)
P.29-40,12
深圳市基础研究重点项目(JCYJ20220818102601004)国家自然科学基金(62503138,62273118)。
评论