摘要

本文系统介绍了 物理信息神经网络(PINN) 在解决实际优化问题中的创新应用。通过将 物理定律 与 神经网络 深度融合,PINN 在摆的倒立控制、最短时间路径规划及航天器借力飞行轨道设计等复杂任务中展现出显著优势。实验表明,PINN 相比传统数值方法及 强化学习(RL)/遗传算法(GA),在收敛速度、解的稳定性及物理保真度上均实现突破性提升。

关键词:物理信息神经网络;优化任务;深度学习;强化学习;航天器轨道


一、引言:优化任务的现实挑战

在芯片设计、航天器轨迹规划、核聚变反应堆控制等前沿工程领域,优化任务始终是技术突破的核心瓶颈。传统数值方法(如 梯度下降、遗传算法)面临计算成本高、扩展性差等问题,而 深度强化学习(RL) 虽在博弈领域大放异彩,但 在连续控制、长期规划场景中存在探索效率低、解不稳定等缺陷。

物理信息神经网络(PINN) 通过将 物理定律 嵌入 神经网络 训练,实现了从数据驱动到物理约束的范式转变。其独特优势在于:

  1. 无需大规模数据:仅需少量边界条件即可建模复杂系统
  2. 全局最优搜索:通过数学目标函数直接优化轨迹
  3. 物理一致性保证:确保解严格满足控制方程

二、PINN核心原理:物理约束与神经网络的完美融合

在这里插入图片描述
利用物理信息损失解决优化任务的神经网络架构。
(a)作为神经网络输入的域变量(例如时间或位置)。
(b)待优化的目标函数(θ\thetaθ),由多层感知机组成。
(c)作为神经网络输出的设计变量。
(d)损失函数(物理损失、约束损失和目标损失),这些损失函数经过加权求和得到最终的目标函数。

2.1 三要素驱动的优化框架

PINN 将优化任务解构为三个核心要素:

  • 控制方程:如 牛顿运动定律、能量守恒方程
  • 约束条件:初始/边界条件、操作限制(如燃料约束)
  • 目标函数:最短时间、最小推力等优化目标

通过将这些要素转化为 神经网络 的损失函数,PINN 实现了对系统行为的精确建模:
θ∗=arg min⁡θ{wphysLphys+wconLcon+wgoalLgoal} \theta^* = \argmin_{\theta} \left\{ w_{\text{phys}} L_{\text{phys}} + w_{\text{con}} L_{\text{con}} + w_{\text{goal}} L_{\text{goal}} \right\} θ∗=θargmin​{wphys​Lphys​+wcon​Lcon​+wgoal​Lgoal​}
其中:

  • 物理损失 LphysL_{\text{phys}}Lphys​ 确保解满足控制方程:
    Lphys(θ)=1NΩ∑j=1NΩ∥F(tj;θ)∥22 L_{\text{phys}}(\theta) = \frac{1}{N_{\Omega}} \sum_{j=1}^{N_{\Omega}} \left\| \mathcal{F}(t_j; \theta) \right\|_2^2 Lphys​(θ)=NΩ​1​j=1∑NΩ​​∥F(tj​;θ)∥22​
  • 约束损失 LconL_{\text{con}}Lcon​ 处理边界条件(Dirichlet/Neumann):
    Lcon(θ)={1N∂Ω∑j=1N∂Ω∥u^(tj;θ)−BC∥22(Dirichlet)1N∂Ω∑j=1N∂Ω∥du^dt(tj;θ)−BC∥22(Neumann) L_{\text{con}}(\theta) = \begin{cases} \frac{1}{N_{\partial \Omega}} \sum_{j=1}^{N_{\partial \Omega}} \| \hat{u}(t_j; \theta) - BC \|_2^2 & \text{(Dirichlet)} \\ \frac{1}{N_{\partial \Omega}} \sum_{j=1}^{N_{\partial \Omega}} \left\| \frac{d\hat{u}}{dt}(t_j; \theta) - BC \right\|_2^2 & \text{(Neumann)} \end{cases} Lcon​(θ)={N∂Ω​1​∑j=1N∂Ω​​∥u^(tj​;θ)−BC∥22​N∂Ω​1​∑j=1N∂Ω​​​dtdu^​(tj​;θ)−BC​22​​(Dirichlet)(Neumann)​
  • 目标损失 LgoalL_{\text{goal}}Lgoal​ 驱动优化方向(如最短时间、最小推力)

2.2 架构创新:非时序优化与全局搜索

传统 RL/GA 依赖时序探索(自底向上),而 PINN 通过单次前向传播直接输出全局最优解。其 神经网络 架构将时间/空间作为输入,输出轨迹/控制变量,结合自动微分技术,高效求解复杂微分方程约束下的优化问题。


三、PINN实战案例:从摆控到星际航行

3.1 案例1:低扭矩摆的倒立控制

挑战:传统 PID控制 在扭矩受限(∣τ∣≤1.5Nm|\tau| \leq 1.5 \text{Nm}∣τ∣≤1.5Nm)时无法使摆倒立,而 RL/GA 需百万次迭代且轨迹波动大。

PINN 解法:

  • 目标损失:Lgoal=(cos⁡ϕ(t=10s)+1)2L_{\text{goal}} = (\cos \phi(t=10s) + 1)^2Lgoal​=(cosϕ(t=10s)+1)2
  • 网络输入:时间 ttt
  • 网络输出:角度 ϕ\phiϕ 与扭矩 τ\tauτ

结果:

  • 仅需9804次迭代即收敛(RL 需10万次)

  • 扭矩轨迹平滑,能量积累效率提升300%(图2)
    在这里插入图片描述
    物理信息神经网络(PINN)在摆锤上摆扭矩方案优化中的应用。
    本文主要探讨了 物理信息神经网络(PINN) 在摆锤上摆扭矩方案优化中的应用。

  • 目标损失:目标损失 Lextgoal=(cosphi(t=10s)+1)2L_{ ext{goal}} = (cos phi(t=10s) + 1)^2Lextgoal​=(cosphi(t=10s)+1)2,这里的目标损失是衡量摆锤达到目标状态的一个量化指标。

  • 网络输入:网络输入为时间 ttt,即网络将时间作为输入信息来进行后续的计算。

  • 网络输出:网络输出为角度 phiphiphi 与扭矩 $ au$,通过输入的时间信息,网络输出摆锤的角度和所需的扭矩。
    (c)迭代过程中损失值的变化历程,这有助于观察网络在训练过程中的收敛情况。
    (d)将运动方程纳入目标函数的神经网络示意图。其输入为 ttt,输出为 phiphiphi 和 $ au$,这种将运动方程融入目标函数的方式是该研究的一个重要特点。
    (e)遗传算法(GA)的基线结果,遗传算法作为一种传统的优化算法,为后续的比较提供了一个基准。
    (f)使用TD3算法的强化学习(RL)基线结果。遗传算法和 强化学习都会产生波动的扭矩方案,这是这两种方法在该问题中的表现特点。
    (g)PINN的结果,该方法确定通过让摆锤来回摆动来积累能量以达到目标,这是 PINN 在该问题上的创新解决方案,让摆锤来回摆动积累能量是关键创新点。
    (h)摆锤上摆过程的几张快照,可以直观地展示摆锤的运动过程。

  • 目标损失:Lgoal=(cos⁡ϕ(t=10s)+1)2L_{\text{goal}} = (\cos \phi(t=10s) + 1)^2Lgoal​=(cosϕ(t=10s)+1)2

  • 网络输入:时间 ttt

  • 网络输出:角度 ϕ\phiϕ 与扭矩 τ\tauτ

(c)迭代过程中损失值的变化历程。
(d)将运动方程纳入目标函数的神经网络示意图。其输入为 ttt,输出为 ϕ\phiϕ 和 τ\tauτ。
(e)遗传算法(GA)的基线结果。
(f)使用TD3算法的强化学习(RL)基线结果。遗传算法和强化学习都会产生波动的扭矩方案。
(g)PINN的结果,该方法确定通过让摆锤来回摆动积累能量以达到目标。
(h)摆锤上摆过程的几张快照。

3.2 案例2:最短时间路径规划

验证场景:

  1. 费马原理:光在变折射率介质中的最短路径
  2. 最速降线:重力场中两点间的最短下降路径

PINN 创新:

  • 将时间 (T) 设为可训练变量
  • 引入 能量守恒约束(最速降线 场景)

实验数据:

方法费马原理 耗时(s)最速降线 耗时(s)
PINN45±2936±11
RL887±7923±8

在这里插入图片描述

在这两幅图中,解析解用黄色虚线表示,PINN得到的收敛解 用蓝色表示。作为基线对比,使用 强化学习(RL) 并经过 (10^5) 次迭代得到的结果用品红色线表示。

3.3 案例3:航天器借力飞行轨道

技术突破:

  • 将推力最小化目标融入运动方程
  • 利用天体引力场实现零燃料轨道

关键公式:
F=1T2d2xdtN2+∑GMo(x−xo)((x−xo)2+(y−yo)2)1.5 \mathcal{F} = \frac{1}{T^2} \frac{d^2 x}{dt_N^2} + \sum \frac{G M_o (x - x_o)}{((x - x_o)^2 + (y - y_o)^2)^{1.5}} F=T21​dtN2​d2x​+∑((x−xo​)2+(y−yo​)2)1.5GMo​(x−xo​)​

实验结果:

  • PINN 推力需求仅为 RL 的1/10(图4)
  • 轨迹对引力场变化鲁棒性提升400%
    在这里插入图片描述
    强化学习(RL)和物理信息神经网络(PINN)在寻找航天器最小附加推力借力飞行轨迹中的应用。
    (a)包含三个天体的系统描述,以及经过 10510^5105 次迭代后,强化学习得到的航天器借力飞行收敛解轨迹。灰色箭头和黄色箭头分别表示引力的 15\frac{1}{5}51​ 和推力。
    (b)每个天体施加的引力大小、总引力、推力,以及强化学习确定的轨迹所需的跟随力。
    (c)经过3215次迭代后,物理信息神经网络得到的航天器借力飞行收敛解轨迹。
    (d)每个天体施加的引力大小、总引力、推力,以及物理信息神经网络确定的轨迹所需的跟随力。

四、性能对比:PINN vs RL/GA

在这里插入图片描述
物理信息神经网络(PINN)、强化学习(RL)和遗传算法(GA)中五个集成模型之间的差异。
(a)学习曲线的变化情况。对于RL和GA的曲线,平滑后的曲线用实线表示,而原始曲线用透明颜色表示。
(b)训练后在没有探索噪声情况下的推理结果变化。目标状态(cos⁡φ=−1\cos\varphi = -1cosφ=−1)也用红色虚线表示。

通过多项实验,对比了 PINN 与 RL、GA 在不同优化任务中的表现,具体结果如下表所示:

任务PINNRLGA
摆的倒立控制(44±16)(892±10)(4015±34)
费马原理(45±29)(887±7)-
最速降线(36±11)(923±8)-
航天器的借力飞行(62±17)(906±12)-

从表中可以看出,在各个任务中,PINN 的运行时间都明显短于 RL 和 GA,体现了其在优化任务中的高效性。

关键结论:

  1. PINN 运行时间仅为 RL 的5-7%,GA 的1-2%
  2. 解的物理保真度提升2-3个数量级(Lphys<10−5L_{\text{phys}} < 10^{-5}Lphys​<10−5)
  3. 无需探索噪声,轨迹稳定性提升5倍以上

五、PINN的优势与局限

5.1 核心优势

  • 逆问题求解:直接优化目标函数,无需时序探索
  • 物理一致性:严格满足控制方程,避免数值漂移
  • 高效性:单卡RTX 3080 Ti即可完成复杂任务

5.2 当前局限

  • 依赖控制方程:在未知物理规律的场景(如生物系统)应用受限
  • 超参数敏感:损失权重需根据任务精细调整

六、未来展望:拓展PINN的应用边界

  1. 代理模型融合:结合数据驱动的代理模型处理未知控制方程
  2. 实时优化:探索 PINN 在自动驾驶、机器人控制中的在线应用
  3. 多目标优化:开发支持复杂约束的多任务学习框架

七、总结

PINN 通过 物理定律 与 神经网络 的深度融合,为实际优化问题提供了兼具效率与精度的解决方案。


参考文献:https://www.nature.com/articles/s41598-023-49977-3
参考代码:https://github.com/jaem-seo/pinn-optimization
数据来源:Nature Scientific Reports (2024) 14:202

Logo

AtomGit 是由开放原子开源基金会联合 CSDN 等生态伙伴共同推出的新一代开源与人工智能协作平台。平台坚持“开放、中立、公益”的理念,把代码托管、模型共享、数据集托管、智能体开发体验和算力服务整合在一起,为开发者提供从开发、训练到部署的一站式体验。

更多推荐