基于卷积神经网络的光学本征模式成像

上一篇

下一篇

周义深, 李琪, 王翔, 宋嘉康, 贾勘序, 张轩阁, 陈希浩. 基于卷积神经网络的光学本征模式成像[J]. 物理学报, 2026, 75(15): 150403. doi: 10.7498/aps.75.20260378
引用本文: 周义深, 李琪, 王翔, 宋嘉康, 贾勘序, 张轩阁, 陈希浩. 基于卷积神经网络的光学本征模式成像[J]. 物理学报, 2026, 75(15): 150403. doi: 10.7498/aps.75.20260378
Yishen ZHOU, Qi LI, Xiang WANG, Jiakang SONG, Kanxu JIA, Xuange ZHANG, Xihao CHEN. Optical eigenmode imaging based on convolutional neural networks[J]. Acta Physica Sinica, 2026, 75(15): 150403. doi: 10.7498/aps.75.20260378
Citation: Yishen ZHOU, Qi LI, Xiang WANG, Jiakang SONG, Kanxu JIA, Xuange ZHANG, Xihao CHEN. Optical eigenmode imaging based on convolutional neural networks[J]. Acta Physica Sinica, 2026, 75(15): 150403. doi: 10.7498/aps.75.20260378

基于卷积神经网络的光学本征模式成像

    作者简介: 周义深: yishenzhou1212@163.com .
    通讯作者: xi-haochen@163.com
  • 中图分类号: 42.30.Va, 42.30.Wb, 89.20.Ff, 42.30.-d

Optical eigenmode imaging based on convolutional neural networks

    Corresponding author: E-mail: xi-haochen@163.com
  • MSC: 42.30.Va, 42.30.Wb, 89.20.Ff, 42.30.-d

  • 摘要: 光学本征模式成像(optical eigenmode imaging, OEI)是一种基于光学系统本征模式展开与投影的计算成像方法, 通过在模式空间中对目标空间分布信息进行表征与重建, 实现目标图像的获取. 然而在低采样率条件下, 传统OEI重建受限于模态不完备性, 导致图像细节丢失与分辨能力受限. 针对此问题, 本文将深度学习引入OEI重建过程, 构建了一种融合物理模型约束的复数卷积神经网络框架. 该方法将OEI物理模型嵌入非预训练复数U-net卷积神经网络中, 并引入注意力机制以增强多尺度特征提取能力, 从而实现了对图像细节的有效恢复. 数值模拟结果表明, 该方法在低采样率下仍能有效恢复图像细节, 在峰值信噪比与结构相似性等指标上显著优于传统算法, 验证了将OEI物理模型与深度学习相融合的可行性, 并为相关计算成像优化提供新思路.
  • 加载中
  • 图 1  (a) 融合注意力机制的U-net网络架构, 包含编码器层(绿色模块)和解码器层(彩色模块); (b) 编码器架构; (c) 解码器架构

    Figure 1.  (a) The U-net architecture incorporating an attention mechanism, comprising encoder layers (green modules) and decoder layers (colored modules); (b) encoder architecture; (c) decoder architecture.

    图 2  (a)卷积块注意力机制(CBAM)模块总览; (b) 空间注意力模块; (c) 通道注意力模块

    Figure 2.  (a) Overview of the convolutional block attention mechanism (CBAM) module; (b) spatial attention module; (c) channel attention module.

    图 3  点扩散函数对比

    Figure 3.  Point spread function comparison.

    图 4  (a)原始物体; (b)传统成像结果; (c) OEI重建结果

    Figure 4.  (a) Ground truth; (b) traditional imaging results; (c) OEI reconstruction results.

    图 5  在不同采样率下, 采用不同重建算法数值模拟得到的“宇航员”图像对比

    Figure 5.  Comparison of numerical simulation results of the “astronaut” image obtained by various reconstruction algorithms at different sampling rates.

    图 6  在不同采样率下, 采用不同重建算法数值模拟得到的“房子”图像对比

    Figure 6.  Comparison of numerical simulation results of the “house” image obtained by various reconstruction algorithms at different sampling rates

    表 1  不同采样率与重建算法下“宇航员”图像的PSNR/SSIM定量比较

    Table 1.  Quantitative comparison of PSNR/SSIM for the “astronaut” image under different sampling rates and reconstruction algorithms

    Methods Sample-rate
    5% 10% 20% 30% 40%
    OEI 15.05/0.47 14.97/0.57 15.07/0.63 15.33/0.64 17.33/0.64
    U-net 17.73/0.69 19.99/0.75 21.21/0.87 23.15/0.88 23.32/0.90
    U-attention 19.25/0.73 21.03/0.81 23.72/0.89 24.38/0.91 24.61/0.93
    下载: 导出CSV

    表 2  不同采样率与重建算法下“房子”图像的PSNR/SSIM定量比较

    Table 2.  Quantitative comparison of PSNR/SSIM for the “house” image under different sampling rates and reconstruction algorithms

    Methods Sample-rate
    5% 10% 20% 30% 40%
    OEI 18.38/0.45 18.97/0.55 19.36/0.66 21.05/0.69 20.63/0.71
    U-net 20.62/0.48 22.37/0.61 23.41/0.71 24.02/0.76 24.37/0.79
    U-attention 21.94/0.51 22.93/0.62 23.45/0.76 25.28/0.79 25.64/0.82
    下载: 导出CSV
  • [1] Luker G D, Luker K E 2008 J. Nucl. Med. 49 1 doi: 10.2967/jnumed.107.045799
    [2] 李龙珍, 姚旭日, 刘雪峰, 俞文凯, 翟光杰 2014 物理学报 63 224201 doi: 10.7498/aps.63.224201 Li L Z, Yao X R, Liu X F, Yu W K, Zhai G J 2014 Acta Phys. Sin. 63 224201 doi: 10.7498/aps.63.224201
    [3] Hell S W 2007 Science 316 1153 doi: 10.1126/science.1137395
    [4] De Luca A C, Kosmeier S, Dholakia K, Mazilu M 2011 Phys. Rev. A 84 021803 doi: 10.1103/PhysRevA.84.021803
    [5] Kosmeier S, Zolotovskaya S, De Luca A C, Riches A, Herrington C S, Dholakia K, Mazilu M 2014 Optica 1 257 doi: 10.1364/OPTICA.1.000257
    [6] Mazilu M, Baumgartl J, Kosmeier S, Dholakia K 2011 Opt. Express 19 933 doi: 10.1364/OE.19.000933
    [7] Kosmeier S 2013 Ph. D. Dissertation (St Andrews: University of St Andrews
    [8] Kosmeier S, De Luca A C, Zolotovskaya S, Di Falco A, Dholakia K, Mazilu M 2013 Sci. Rep. 3 1808 doi: 10.1038/srep01808
    [9] Piché K, Leach J, Johnson A S, Salvail J Z, Kolobov M I, Boyd R W 2012 Opt. Express 20 26424 doi: 10.1364/OE.20.026424
    [10] Tsampoula X, Mazilu M, Vettenburg T, Gunn-Moore F, Dholakia K 2013 Photon. Res. 1 42 doi: 10.1364/PRJ.1.000042
    [11] Johnson A S, Piché K, Salvail J Z, Leach J, Boyd R W 2013 J. Mod. Opt. 60 1931 doi: 10.1080/09500340.2013.867096
    [12] Wang W, Wang Y P, Wu Y, Yang X X, Wu Y 2014 Opt. Lett. 39 2614 doi: 10.1364/OL.39.002614
    [13] Kosmeier S, Mazilu M, De Luca A C, Baumgartl J, Dholakia K 2012 Complex Light and Optical Forces VI San Francisco, California, USA, January 25–26, 2012 p82740I
    [14] Zhang S Z, Wang W, Yu R, Yang X X 2016 Laser Phys. Lett. 13 015003 doi: 10.1088/1612-2011/13/1/015003
    [15] Baumgartl J, Kosmeier S, Mazilu M, Rogers E T F, Zheludev N I, Dholakia K 2011 Appl. Phys. Lett. 98 181109 doi: 10.1063/1.3587636
    [16] Lyu M, Wang W, Wang H, Wang H C, Li G W, Chen N, Situ G H 2017 Sci. Rep. 7 17865 doi: 10.1038/s41598-017-18171-7
    [17] Koetzier L R, Mastrodicasa D, Szczykutowicz T P, van der Werf N R, Wang A S, Sandfort V, van der Molen A J, Fleischmann D, Willemink M J 2023 Radiology 306 e221257 doi: 10.1148/radiol.221257
    [18] Cammarasana S, Nicolardi P, Patanè G 2022 Med. Biol. Eng. Comput. 60 2229 doi: 10.1007/s11517-022-02573-5
    [19] Adegun A A, Fonou Dombeu J V, Viriri S, Odindi J 2023 Sensors 23 5849 doi: 10.3390/s23135849
    [20] Thapa A, Horanont T, Neupane B, Aryal J 2023 Remote Sens. 15 4804 doi: 10.3390/rs15194804
    [21] Xu Y B, Lu L Y, Saragadam V, Kelly K F 2024 Nat. Commun. 15 1456 doi: 10.1038/s41467-024-45856-1
    [22] Zhao W Z, Du S H 2016 IEEE Trans. Geosci. Remote Sens. 54 4544 doi: 10.1109/TGRS.2016.2543748
    [23] Liu P, Zhang H, Eom K B 2017 IEEE J. Sel. Top. Appl. Earth Obs. Remote Sens. 10 712 doi: 10.1109/JSTARS.2016.2598859
    [24] Tang P W, Lin C H, Liu Y R 2024 IEEE Trans. Geosci. Remote Sens. 62 1 doi: 10.1109/TGRS.2024.3349479
    [25] Ahmed M T, Monjur O, Kamruzzaman M 2024 J. Food Eng. 382 112223 doi: 10.1016/j.jfoodeng.2024.112223
    [26] Song K, Bian Y X, Wu K, Liu H R, Han S P, Li J M, Tian J Z, Qin C B, Hu J Y, Xiao L T 2023 arXiv: 2310.16869 [eess.IV]
    [27] Kilcullen P, Ozaki T, Liang J 2022 Nat. Commun. 13 7879 doi: 10.1038/s41467-022-35585-8
    [28] Donoho D L 2006 IEEE Trans. Inf. Theory 52 1289 doi: 10.1109/TIT.2006.871582
    [29] Duarte M F, Davenport M A, Takhar D, Laska J N, Sun T, Kelly K F, Baraniuk R G 2008 IEEE Signal Process. Mag. 25 83 doi: 10.1109/MSP.2007.914730
    [30] Lin J, Yan Q R, Lu S, Zheng Y J, Sun S D, Wei Z 2022 Photonics 9 343 doi: 10.3390/photonics9050343
    [31] Wang F, Wang C L, Deng C J, Han S S, Situ G H 2022 Photon. Res. 10 104 doi: 10.1364/PRJ.440123
    [32] Hoshi I, Shimobaba T, Kakue T, Ito T 2020 Opt. Express 28 34069 doi: 10.1364/OE.410191
    [33] Wang F, Czarske J W, Situ G H 2025 Adv. Photon. 7 054002 doi: 10.1117/1.AP.7.5.054002
    [34] Wang M Y, Mao J N, Su H, Ling Y Y, Zhou C Q, Su Y K 2024 Biomed. Opt. Express 15 6619 doi: 10.1364/BOE.538756
    [35] Wang C H, Li H Z, Bie S H, Lv R B, Chen X H 2023 Photonics 10 224 doi: 10.3390/photonics10020224
    [36] 党诗沛, 李润泽, 周美玲, 千佳, 但旦, 于湘华, 姚保利 2022 红外与激光工程 51 20220735 doi: 10.3788/IRLA20220735 Dang S P, Li R Z, Zhou M L, Qian J, Dan D, Yu X H, Yao B L 2022 Infrared Laser Eng 51 20220735 doi: 10.3788/IRLA20220735
    [37] Minin I, Minin O 2016 Diffractive Optics and Nanophotonics (Cham: Springer) pp1–5
    [38] Wang D Y, Bie S H, Chen X H, Yu W K 2024 Photonics 11 174 doi: 10.3390/photonics11020174
  • 加载中
图( 6) 表( 2)
计量
  • 文章访问数:  128
  • HTML全文浏览数:  128
  • PDF下载数:  0
  • 施引文献:  0
出版历程
  • 收稿日期:  2026-03-17
  • 刊出日期:  2026-08-05

基于卷积神经网络的光学本征模式成像

    通讯作者: xi-haochen@163.com
    作者简介: 周义深: yishenzhou1212@163.com
  • 辽宁大学物理学院, 沈阳 110036

摘要: 光学本征模式成像(optical eigenmode imaging, OEI)是一种基于光学系统本征模式展开与投影的计算成像方法, 通过在模式空间中对目标空间分布信息进行表征与重建, 实现目标图像的获取. 然而在低采样率条件下, 传统OEI重建受限于模态不完备性, 导致图像细节丢失与分辨能力受限. 针对此问题, 本文将深度学习引入OEI重建过程, 构建了一种融合物理模型约束的复数卷积神经网络框架. 该方法将OEI物理模型嵌入非预训练复数U-net卷积神经网络中, 并引入注意力机制以增强多尺度特征提取能力, 从而实现了对图像细节的有效恢复. 数值模拟结果表明, 该方法在低采样率下仍能有效恢复图像细节, 在峰值信噪比与结构相似性等指标上显著优于传统算法, 验证了将OEI物理模型与深度学习相融合的可行性, 并为相关计算成像优化提供新思路.

English Abstract

    • 光学成像作为科学研究和工程应用的核心技术之一[1], 其分辨率长期以来受到衍射极限的制约[2]. 如何在保证系统稳定性和低成本的前提下突破这一限制, 进而实现更高质量的成像, 是近年来计算光学领域的重要研究方向[3]. 光学本征模式成像(optical eigenmode imaging, OEI)作为一种新兴的间接成像方法[4], 能够通过模态分解实现振幅与相位的同步获取[5]. 由于目标信息可由少数主要光学本征模式高效表征, OEI本身具有压缩采样的潜力[6]; 同时, 依托于本征模式的正交性和独立性, 它能够有效抑制像差影响, 保持图像质量与细节恢复[7], 因此OEI技术逐渐受到学术界的广泛关注. 其基本原理是将光场分解为一组正交的本征模式, 通过提取目标光场在本征模态下的投影系数, 从而实现复振幅的重建[8]. 此外, OEI在实验中已展现出突破瑞利判据的分辨率潜力[9]. 凭借这一特性, OEI在生物成像[10]、光谱探测[11]以及远程感知[12]等应用中显示出良好的发展前景. 然而, OEI也面临不可忽视的挑战. 由于现有条件下可生成和测量的本征模式数量有限, 模态集合往往不完备, 从而导致高频细节难以有效恢复[13]. 缺失模态所对应的信息丢失, 会引发系统点扩散函数(point spread function, PSF)的旁瓣增强, 进而造成图像边缘模糊、细节丢失等问题[14]. 这一问题在低采样率条件下尤为显著, 使得传统OEI方法在重建质量方面受到限制[15]. 因此, 如何在不显著增加测量复杂度的前提下提升OEI的重建质量, 已成为亟待解决的关键问题.

      近年来, 深度学习技术的快速发展为计算成像领域带来了新的机遇[16]. 在医学领域, 深度神经网络已被广泛应用于计算机体层摄影图像重建[17]、超声图像去噪[18]等任务, 大大提高了成像速度和质量. 在遥感成像中, 深度学习被用于处理多维度数据进行目标检测[19]和图像分类[20]; 高光谱成像中[21], 深度学习已广泛用于处理高维特性[22]、应对分类挑战[23]和求解图像重建逆问题[24], 通过自主学习特征, 实现了对不完整物理测量的恢复和重建质量的显著提升[25]. 此外, 深度学习在单像素成像(single-pixel imaging, SPI)领域的应用也取得了显著进展[26]. 通过结合单像素探测器和多种调制模式[27], SPI能够实现图像重建, 而深度学习的引入能够显著提高重建质量, 尤其在低采样率[28]和高噪声环境下[29]表现尤为出色. 这些研究表明, 深度学习不仅能够加速传统图像重建过程, 还能在复杂环境下实现噪声抑制, 极大地拓展了成像技术的应用范围. 尤其是物理驱动型卷积神经网络(convolutional neural network, CNN)方法[30], 能够将成像模型直接嵌入网络框架[31]在无监督的条件下进行优化[32], 从而避免对大规模训练数据的依赖[33]. 这一特点与OEI的成像过程天然契合: OEI已知的模态投影物理模型可作为约束条件引入网络优化, 使得深度学习能够充分发挥特征提取与非线性映射的优势, 并保证重建结果与原始目标模型的高度一致性.

      因此, 本文提出了一种基于卷积神经网络的OEI重建方法. 该方法以OEI的物理投影模型为基础, 设计了一个融合通道注意力模块与空间注意力机制模块的多尺度U-net卷积网络. 在网络训练过程中, 随机初始化权重, 并通过与OEI物理测量过程的迭代交互来优化网络参数. 具体而言, OEI的物理模型用于生成预测的模态投影系数, 并与仿真设定的投影数据进行对比, 二者之间的误差作为损失函数, 指导网络参数的更新. 这样, 网络的优化过程完全由物理约束驱动, 无需依赖额外的训练样本或先验数据集.

    • 在OEI成像理论中, 探测平面上线性偏振光场的复振幅分布为$ E({\boldsymbol{r}}) $, 其时间演化因子约定为$ \mathrm{e}^{{\rm{i}}{{\omega}} {{t}}} $, 其中ω为光波角频率, $ {\boldsymbol{r}}=(x, y) $为成像或探测平面上的二维空间坐标矢量. 该任意空间相干光场$ E({\boldsymbol{r}}) $均可展开在一组预先选定的测试场模态集合$ \{u_j({\boldsymbol{r}})\}_{j=1}^{N} $上:

      其中N为测试场模式总数, $ a_j \in \mathbb{C} $为各模态对应的复振幅展开系数. 相应的复共轭形式为

      一组测试场模态$ \{u_j({\boldsymbol{r}})\} $若要唯一表示任意光场$ E({\boldsymbol{r}}) $, 必须满足线性无关且完备性条件, 即它们构成光场所在空间的一个基底. 测试场$ u_j({\boldsymbol{r}}) $可为复值分布(由仿真预设), 用于对光场的空间结构进行表征. 在感兴趣区域(region of interest, ROI)上, 定义光场强度泛函

      其中$ {\rm{d}}\sigma $为面积元, 积分区域ROI通常对应于探测器的有效感光区域. 将(1)式与(2)式代入(3)式, 引入独立求和指标k以区分共轭项并定义测试场之间的相关矩阵为M, 其矩阵元为

      其中$ M_{jk} $为测试场模式$ u_j({\boldsymbol{r}}) $$ u_k({\boldsymbol{r}}) $在ROI中的内积, 用于表征各测试场模态中的空间相关性. 则有

      其中$ {\boldsymbol{a}} = [a_1, a_2, \cdots, a_N]^{\rm{T}} $为系数列向量, $ {\boldsymbol{a}}^{\dagger} $为其厄米共轭. 对矩阵M进行本征值分解, 得到的特征值$ {\lambda ^\ell } $和特征向量$ {\boldsymbol v}_{\ell j} $满足

      利用特征值和特征向量, 光学本征模$ \mathbb{E}_\ell({\boldsymbol{r}}) $和其共轭形式$ \mathbb{E}_\ell^{*}({\boldsymbol{r}}) $可以定义为测试场模态$ u_j({\boldsymbol{r}}) $的线性组合:

      其中, 特征值$ {\lambda ^\ell } $的大小反映了该本征模在光场强度中的贡献程度, 特征向量$ {\boldsymbol v}_{\ell j} $给出了测试场模式$ u_j({\boldsymbol{r}}) $的权重. 这些光学本征模在ROI内满足正交归一化条件

      其中$ \delta_{jk} $为克罗内克函数, 当且仅当$ j=k $时为1, 其余为0. 对于未知的目标场$ T({\boldsymbol{r}}) $(即目标物的复透射函数), 可以将其投影到这组正交归一的本征模基底上. 目标场$ T({\boldsymbol{r}}) $在第$ \ell $个本征模上的复投影系数定义为

      其代表了该本征模式在目标光场展开中的复振幅权重, 其中ROI表示探测器的有效感光区域. 进一步, 利用该组投影系数, 可通过光学本征模的线性叠加重建目标场

      在理想情况下若本征模集合完备, 目标场可由(11) 式精确重建[4].

    • 在仿真过程中, 光学本征模系的构造是OEI图像重建的基础. 本文选用二维Laguerre-Gaussian (LG)模式作为测试场集合$ \{u_j({\boldsymbol{r}})\} $. 第j个测试场$ u_j $由特定的径向阶数$ p_j $和角向阶数$ l_j $唯一确定, 其在极坐标系$ (r, \phi) $下的分布为

      其中, $ (r, \phi) $为极坐标下的径向和角向坐标, $ \omega_0 $为光束腰参数, $ {\rm{L}}_p^{|l|}(\cdot) $为广义拉盖尔多项式. 在后续的数值计算与图像重建中, 将上述解析表达式离散化映射至直角坐标系$ (x, y) $下, 记为$ u_j(x, y) $. 基于(4) 式定义的内积关系, 在ROI区域内对矩阵M进行特征分解, 得到本征值$ \lambda^\ell $和本征向量$ {\boldsymbol v}_{\ell, j} $, 从而构建光学本征模式$ \mathbb{E}_{\ell}(x, y) $, 其表达式为

      为实现图像重建, 设目标为$ O(x, y) $, 计算其在光学本征模式上的投影系数$ s_\ell $:

      最终重建的目标为

      通过这种方式, 可以基于实际获取的复振幅进行重建. 与传统的图像重建计算方法相比, 基于物理驱动DL的重建方法被证明能够有效地避免巨大的计算负担并获得高质量的重建结果[34]. 将OEI物理模型嵌入到随机初始化的非预训练CNN中, 通过在网络优化过程中引入成像物理模型作为反馈约束来实现高质量的图像重建. 网络以随机复值噪声图z, 输出预估的目标复场$ \tilde{T}_{\theta}(z) $, 该重建过程的目标函数可表示为

      式中, 损失函数$ {\cal{L}}(\theta) $具体定义为

      其中, θ代表网络权重; $ \mathbb{E}_{\ell} $为第$ \ell $个光学本征模式; $ s_\ell $表示仿真中基于真实物理模型得到的第$ \ell $个本征模式的复投影系数; $ \tilde{s}_\ell $表示网络输出的预估重建复场$ \tilde{T}_\theta(z) $与本征模$ \mathbb{E}_{\ell} $之间的复内积, 即$ \tilde{s}_{\ell} = \langle \tilde{T}_{\theta}(z), E_{\ell} \rangle $. (17) 式的第一项中$ |\cdot|^2 $代表复数域下的模长平方, 其计算了预测系数与真实系数在复平面上的平方误差; 第二项中$ {\rm TV}(\cdot) $是改善重建图像质量的正则化约束, ζ用来平衡正则化在重建过程中的权重.

      重建过程的迭代步骤如下: 1)将随机复值噪声图z作为网络的唯一输入, 输入到随机初始化的非预训练CNN中, 本文采用的网络架构为标准复数U-net与融合注意力机制的扩展版. 预先计算的本征模式$ \mathbb{E}_\ell $和仿真投影系数$ s_\ell $在每步迭代中用于计算物理约束损失, 而不作为网络的直接输入. 2)网络输出重建的复场$ \tilde{T}_{\theta}(z) $. 3)将网络输出$ \tilde{T}_{\theta}(z) $与OEI的物理投影过程融合, 计算网络估计的投影系数$ \tilde{s}_\ell = \langle \tilde{T}_{\theta}(z), \mathbb{E}_\ell \rangle $, 并依据(17)式计算损失函数$ {\cal{L}} $. 4)采用Adam优化器来更新神经网络权重θ, 以最小化损失函数$ {\cal{L}} $. 重复步骤3)和4), 直到损失函数收敛, 获得最佳权重并输出最终的重建复场.

    • 与传统的用于SPI图像重建的U-net结构不同[35], 以携带相位信息的LG模式作为测试场, 构造出的光学本征模式$ \mathbb{E}_{\ell} $为复数场, 因此目标场在这些模式下的投影系数$ s_\ell $亦为复数. 为此, 本研究设计了支持复数运算的U-net网络, 通过将实部和虚部作为两个独立通道输入和输出, 实现对复场$ T = T_{\rm{r}} + {\rm{i}}T_{\rm{i}} $的有效重建. 输入的复场数据被表示为两个独立的通道: 实部$ T_{\rm{r}} $和虚部$ T_{\rm{i}} $. 这一设计确保了网络在多层卷积、池化以及注意力机制处理过程中, 能够同时提取和维护复场在振幅和相位上的连贯特征, 这对于精确地恢复光学模场的细节信息至关重要. 网络主体如图1(a)所示, 其基于经典U-net的“U”字形多尺度架构, 由对称的编码器和解码器组成. 编码器位于左侧, 负责特征提取和空间压缩: 接收$ H \times W $输入复场, 首先通过连续卷积层将输入映射至高维特征空间. 随后, 利用如图1(b)所示的编码器模块执行下采样任务: 用$ 5 \times 5 $的卷积核通过步长为2的卷积操作替代传统池化层, 依次经过卷积、批归一化(batch normalization, BN)和Leaky ReLU激活, 将特征图空间尺寸逐层减半, 同时特征通道数逐层翻倍. 最终, 网络在瓶颈层特征维度达到峰值, 同时空间维度被大幅压缩. 解码器位于右侧, 结构与编码器相互对称, 其核心任务是通过转置卷积操作逐步进行上采样, 将空间分辨率恢复到原始大小$ H \times W $. 在每个上采样层之后, 解码器都通过跳跃连接(skip connections)将编码器中对应尺度的特征图进行通道拼接, 然后进行进一步的卷积处理. 这种连接机制有效融合了编码器保留的高分辨率局部细节与解码器提取的低频全局上下文特征, 是U-net能够高效进行图像重建任务的关键设计. 在网络末端, 解码器通过一个卷积层将特征通道数最终恢复到2, 输出重建复场T的实部和虚部, 并可选择Sigmoid激活函数. 此外, 为了将网络输出与OEI的物理仿真过程相连接, 网络还并行计算了重建复场T在预置模场$ \mathbb{E}_{\ell} $上的投影系数$ \langle T, \mathbb{E}_{\ell} \rangle $. 具体而言, 将网络输出的双通道分别定义为重建场的实部$ T_{{{\mathrm{r}}}} $和虚部$ T_{{{\mathrm{i}}}} $, 同时将第$ \ell $个本征模$ \mathbb{E}_\ell $分解为实部$ \mathbb{E}_{\ell, {\rm{r}}} $和虚部$ \mathbb{E}_{\ell, {\rm{i}}} $. 投影系数的计算通过复共轭乘积的展开形式实现:

      为了进一步提升网络对关键特征的识别和表达能力, 本文引入了如图2(a)所示的卷积块注意力机制模块(convolutional block attention module, CBAM), 并将其嵌入到解码器的每个上采样层以及瓶颈层之后. CBAM的主要目标是通过通道注意力模块(channel attention module, CAM)和空间注意力模块(spatial attention module, SAM)来提高模型的感知能力. CAM用于自适应地调整各特征通道的重要性, 而SAM旨在赋予特征图不同空间位置以不同的权重, 两者结合后能够从通道和空间两个维度对特征进行优化加权. CAM首先对输入特征图(尺寸$ H \times W \times C $)进行全局平均池化和全局最大池化操作, 生成两个$ {1 \times 1 \times C} $的全局描述向量. 这两个向量随后经过一个共享参数的两层全连接网络(shared MLP), 以实现通道间的交互和降维/升维操作. 具体来说, 该MLP先将维度降至$ C/8 $, 经过ReLU激活后, 再恢复至原始通道数C. 将两个MLP输出相加后, 通过Sigmoid激活函数, 生成最终的$ 1 \times 1 \times C $通道注意力权重. 随后, 将此权重与原始特征图进行逐通道相乘. 紧接着, SAM作用于经CAM加权后的特征图. SAM首先在通道维度上进行平均池化和最大池化操作, 将原始特征图压缩为两个$ H \times W \times 1 $的单通道特征图. 随后, 将两者沿通道轴拼接成$ H \times W \times 2 $的特征图, 并输入到一个单卷积核的卷积层中. 最终, 通过Sigmoid激活函数将输出映射到$ (0, 1) $区间, 生成$ H \times W \times 1 $的空间注意力权重. 该空间权重与经过CAM作用的特征图进行逐元素相乘, 得到最终同时具备通道和空间注意力加权的特征图. 在该过程中, 选用Adam优化器, 并设置初始学习率(learning rate, LR)为$ 0.01 $. 通过不断迭代更新网络权重, 最小化损失函数, 最终得到高质量重建结果.

    • 在光学本征模式成像系统中, 超分辨率的实现核心在于利用本征模式的线性叠加, 在重构场中构建出有效宽度远小于瑞利判据的主瓣分布, 从而突破传统直接成像的衍射极限. 为了评估该系统的成像分辨率, 本文考察系统对理想点源的响应特性, 即点扩散函数. 设目标场$ T({\boldsymbol{r}}) $为位于$ \boldsymbol{r}_{{0}} $处的理想点源, 在数学上可由δ函数描述, 即$ T({\boldsymbol{r}}) = \delta({\boldsymbol{r}} - {\boldsymbol{r}}_{{0}}) $. 根据(10)式, 该点源在第$ \ell $个本征模式上的投影系数为$ s_\ell $

      将此系数代入重建公式(15), 即可得到系统对该点源的响应, 即系统的点扩散函数$ E_{\text{PSF}} $:

      $ E_{\mathrm{PSF}} $的空间扩展程度, 例如以半高宽(full width at half maximum, FWHM)为指标, 直接表征系统的空间分辨率. 对于理想的无像差系统, 该分辨率受限于光学衍射极限, 其理论值通常由瑞利判据计算. 对于一个焦距$ f = 400 $ mm, 波长$ \lambda = 632 $ nm, 透镜直径为$ d = 2 $ mm的成像透镜系统, 依据瑞利判据[36], 该系统的理论空间分辨极限$ \Delta x $

      该系统的理论衍射极限约为$ 154.4\, {\text{μ}}\mathrm{m} $. 这一分辨极限取决于衍射受限系统的PSF, 即Airy斑的空间展宽. 作为理想点源在像平面的响应, Airy斑的径向强度分布直接制约了系统的分辨能力, 其解析表达式为[37]

      其中$ {\rm J}_1(u) $是第一类贝塞尔函数, u 是衍射参数.

      为验证OEI系统的超分辨潜力, 以LG模式作为测试场, 在64 × 64像素网格构造光学本征模式, 并据此计算$ E_{\mathrm{PSF}} $与Airy PSF的比较曲线. 仿真结果如图3所示,在离散化空间映射中, 由Airy PSF空间展宽所决定的这一理论分辨率表现为约17个像素的特征宽度, 而$ E_{\mathrm{PSF}} $的FWHM仅为2个像素, 显著优于Airy PSF的FWHM. 同时$ E_{\mathrm{PSF}} $的主瓣更尖锐, 旁瓣抑制更显著, 证实OEI系统能够实现比传统成像方法更高的分辨率.

      为进一步验证OEI系统的超分辨潜力, 本文设计了对双缝物体的数值仿真对比. 模拟参数设置如下: 采样网格为$ 64 \times 64 $, 构建的双缝物体每条狭缝宽4个像素, 中心间距为13个像素. 仿真中, 原始物体设定为理想的双缝矩形分布. 作为对比, 衍射受限的成像效果通过原始图像与系统Airy PSF的卷积获得; OEI重建则利用1638个光学本征模式, 通过计算模态投影系数复原目标的复场分布, 并进一步提取其强度分布以进行图像显示与评估. 数值模拟结果如图4所示, 可以看出, 真实目标呈现锐利的双缝结构; 传统成像边缘显著模糊, 两缝无法有效分辨; OEI重建则显著提升了边缘锐度和对比度, 两缝清晰可辨, 验证了其超分辨能力.

    • 为验证所提方法在OEI中的有效性, 本研究选取了$ 64 \times 64 $像素的灰度图像“宇航员”、“房子”作为目标物体进行数值仿真. 仿真过程严格依据OEI物理机制: 首先基于预设的采样率(sampling rate, SR)生成$ N_{\text{SR}} $个不同阶数的LG模式作为测试场$ \{u_{j}({\boldsymbol{r}})\} $, 其中$ N_{\text{SR}} = \text{SR} \times 64 \times 64 $. 随后, 通过计算所有$ N_{\text{SR}} $个测试场模式之间的复共轭内积, 构造维度为$ N_{\text{SR}} \times N_{\text{SR}} $的相关矩阵M. 接着, 矩阵 M 进行本征值分解, 构造一组正交归一化的光学本征模式$ \mathbb{E}_{\ell}({\boldsymbol{r}}) $. 最后计算目标在本征模基底下的投影系数. 并分别利用传统OEI、基础U-net以及U-attention网络进行图像重建.

      为全面评估算法性能, 仿真设置了$ \text{SR} \in \{5{\text{%}}, 10{\text{%}},\; 20{\text{%}}, \;30{\text{%}}, \;40{\text{%}}\} $的采样率集合. 图5图6分别展示了“宇航员”与“房子”在不同采样率下, 三种算法的重建结果对比. 从视觉效果来看, 传统OEI算法受限于模态基底的不完备性, 成像质量随采样率降低而显著恶化. 在$ {\mathrm{SR}} = 10{\text{%}} $时, OEI重建结果虽能呈现目标的全局结构, 但细节模糊; 当采样率降至$ {\mathrm{SR}} = 5{\text{%}} $时, 高频信息严重丢失, 图像不仅模糊且伴有明显伪影. 基础U-net模型在一定程度上提升了图像的对比度, 但在$ {\mathrm{SR}} = 5{\text{%}} $条件下, 由于物理驱动约束在极低采样下的欠定性, 重建结果中仍伴随有斑点状伪影. 相比之下, 融合了注意力机制的U-attention模型在视觉保真度上表现更优. 得益于注意力模块对空间边缘特征的自适应强化, 即便在$ {\mathrm{SR}} = 5{\text{%}} $的极端条件下, 虽然受限于物理极限, 图像无法达到高清晰度, 但相比于其他算法, 该模型重构的图像表现出更好的几何规整性与结构连续性, 有效地抑制了背景区域的伪影波动对主体轮廓的干扰. 为进一步量化重建质量, 采用峰值信噪比(peak signal-to-noise ratio, PSNR)和结构相似性(structural similarity, SSIM)[38]作为评价指标, 两个目标物体在不同算法下定量比较重建结果分别列于表1表2. 数据表明, U-attention方法在所有采样率下的性能指标均显著优于对比方法. 在极度稀疏采样条件$ {\mathrm{SR}} = 5{\text{%}} $时, 针对“宇航员”图像, U-attention的PSNR达到19.25 dB, SSIM为0.73, 相比基础U-net (PSNR 17.73 dB, SSIM 0.69)分别提升了1.52 dB和0.04. 这一优势在“房子”图像的重建中同样显著, 其PSNR达到21.94 dB, 超过传统OEI的18.38 dB. 这表明, 即便在视觉感知较为模糊的极端低采样条件下, 注意力机制依然能够通过对核心特征权重的精准捕捉, 使重建结果接近真实值, 显著缓解高频模态缺失带来的结构性损失. 随着采样率增加至$ {\mathrm{SR}} = 40{\text{%}} $时, 该模型的优势依然稳固, “宇航员”重建图像PSNR提升至24.61 dB, SSIM达到0.93, 相比U-net分别实现了1.29 dB和0.03的提升. 上述结果证实, 即使在数据冗余度较高的情况下, 注意力机制依然能够通过精细化处理不同尺度的特征图贡献, 帮助网络逼近重建性能的理论上限, 从而在PSNR和SSIM上均实现最优表现.

      仿真结果表明, 相比受限于模态不完备性的传统OEI以及在极低采样下细节恢复能力不足的基础U-net, 引入注意力机制的U-attention网络通过自适应校准特征权重, 使得网络能够优先聚焦于关键的结构特征, 从而有效弥补了物理模型在欠采样下的高频信息缺失, 更助推网络在全采样率范围内逼近性能理论上限, 实现了对伪影抑制与结构保真度的双重优化.

    • 本文针对传统OEI方法在低采样率条件下重建质量受限的问题, 构建了在OEI物理模型约束下融合注意力机制的复数卷积神经网络重建策略. 研究首先从成像机理层面验证了OEI系统的超分辨成像潜力, 仿真结果表明, OEI系统能够有效突破传统光学系统的衍射极限, 并成功实现对瑞利判据下不可分双缝物体的清晰分辨. 在此物理基础上, 为解决欠采样带来的高频模态缺失难题, 本文将OEI物理模型嵌入复数U-net架构作为约束, 并进一步引入注意力机制以增强多尺度特征提取能力. 与传统OEI及基础U-net方法相比, U-attention方法能够有效提升重建图像的细节与信噪比, 尤其在低采样率下表现出优越的性能. 仿真结果表明, 该方法能够在低采样率下恢复结构清晰的图像, 并在PSNR和SSIM指标上显著优于对比方法. 此外, 该策略有效结合了物理先验与深度学习的非线性重构优势, 为解决OEI重建中的挑战提供了一种新的思路. 目前的方案主要验证了数值模拟环境下的有效性, 未来研究将致力于开展实际光学实验, 验证该策略在真实复杂物理环境下的鲁棒性, 并进一步优化网络训练效率.

    参考文献 (38)

目录

/

返回文章
返回