← 返回 PaperDaily 视觉与图像

Nyström把核方法瘦身了:大规模去噪还能省算力

这篇论文把“核方法太慢”这件老毛病,直接交给Nyström子采样来处理,而且不是只顾着快,还给出了向量值回归场景下的收敛理论。更关键的是,它把去噪这类很实用的问题也一起纳入框架,属于既能打理论、又能落地的那种。

Nyström把核方法瘦身了:大规模去噪还能省算力
🐉 龙哥读论文知识星球来了!
公众号每日8篇拆解不够看?星球无上限更AI领域论文、资讯、招聘、招博、开源代码,一站式干货,每日2分钟刷完即赚!
👇扫码加入「龙哥读论文」知识星球,前沿干货、实用资源一站式拿捏~ xingqiu_header

龙哥推荐理由:
这篇论文把“核方法太慢”这件老毛病,直接交给Nyström子采样来处理,而且不是只顾着快,还给出了向量值回归场景下的收敛理论。更关键的是,它把去噪这类很实用的问题也一起纳入框架,属于既能打理论、又能落地的那种。


原论文信息如下:
论文标题:
Scalable Operator Learning via Nyström Approximation with Denoising Applications
发表日期:
2026年06月
发表单位:
Pennsylvania State University; Indian Institute of Technology Delhi
原文链接:
https://arxiv.org/pdf/2606.26652v1.pdf

计算瓶颈下的去噪困境

去噪这件事,看起来像是“把脏东西擦掉”,实际上常常是和结构信息抢地盘:噪声要去掉,信号还不能被顺手抹平。音频要保留音色和瞬态,图像要保留边缘和纹理,CT 重建还得兼顾物理成像规律。于是,很多方法都在“去噪”这个任务上卷出了花,但一旦数据规模上来,核方法就开始露出本性——效果不错,代价也不小
这篇论文盯住的核心矛盾很直接:核方法太慢。标准核回归在训练样本数为 n 时,通常要构造并求逆一个 n×n 的核矩阵,时间复杂度大致是 O(n3),存储复杂度是 O(n2)。样本一多,机器就会开始沉默,仿佛在说:“我不是不会算,我只是算不动。”而去噪任务偏偏又很爱大数据、长序列、高分辨率图像和实时流式输入,这就把核方法逼到了墙角。
作者没有选择把核方法一脚踢开,而是给它“做减法”——用Nyström 子采样来近似原始核矩阵。Nyström 方法的直觉很朴素:既然全量核矩阵太大,那就挑一小撮代表点,先把大矩阵的骨架搭出来,再用低秩近似去替代完整计算。这样一来,很多原本要在 n 维空间里硬刚的操作,就能缩到 m 维,m 远小于 n,算力压力立刻轻松不少。
图1:运动模糊下,KRR、Nyström 近似、BM3D 和 DnCNN 的重建结果对比
图1:运动模糊下,KRR、Nyström 近似、BM3D 和 DnCNN 的重建结果对比。可以先记住一个结论:Nyström 不是来“另起炉灶”的,而是来把核方法的体积压下去,同时尽量保住原有效果。
这里顺手解释两个缩写。KRRKernel Ridge Regression,中文常译为核岭回归,是核方法里最经典的一类回归模型;Nyström 则是经典的核矩阵低秩近似思路,用少量子样本逼近整体结构。论文中的目标不是把核方法替换掉,而是证明:在向量值回归和算子学习场景里,Nyström 也能站得住

Nystrom子采样:为核方法瘦身

这篇工作的关键,不只是“把核矩阵变小”,而是把问题放进了向量值再生核希尔伯特空间里去处理。英文全称是 vector-valued reproducing kernel Hilbert space, vRKHS,中文可以理解成向量值再生核希尔伯特空间。它和普通标量核回归最大的不同在于:输出不再是一个数,而可能是一段波形、一张图像,甚至一个函数。说白了,普通回归像“报一个分数”,向量值回归更像“交一整篇作业”。
论文采用的是一种标量乘性核(scalar multiplicative kernel)。它的形式可以理解为:输入端用一个普通标量核 k(x,x′) 描述相似性,输出端再乘上单位算子 Id,让核从标量世界扩展到函数输出世界。这样做的好处是结构清楚,理论可推,且能和算子学习自然接轨。听起来很学术,翻译成人话就是:先把输入相似度算明白,再把“输出是函数”这件事接上去
Nyström 子采样的流程并不玄学。先从训练样本里抽出 m 个代表点,构造一个低秩子空间;再只在这个子空间里做正则化学习。原本需要在全量核矩阵上求解的问题,现在变成了在更小的近似空间里找最优解。论文还把这个过程写成了算子形式,并给出了与 Hilbert–Schmidt 算子之间的对应关系。这里的 Hilbert–Schmidt 算子可以粗略理解为“平方可积的线性算子”,是把无限维问题写得更像线性代数的那根桥梁。
图3:Gaussian 核与 IMQ 核下,m 与 λ 的热力图结果
图3:Gaussian 核与 IMQ 核下,m 与 λ 的热力图结果。这里能看出两个调参旋钮的关系:m 决定“近似得有多像”,λ 决定“正则得有多稳”。
更具体地说,论文给出了两种等价的表达方式:一种是把最优解写成对训练样本的线性组合,另一种是把问题转成低秩子空间中的矩阵求解。前者更像理论表达,后者更像工程实现。两者的共同目标只有一个:把 O(n3) 的大工程,压成 O(nm2) 甚至更友好的规模。如果 m 选得合适,精度不会塌,速度却能明显起飞。
为了让这件事更落地,论文把去噪任务拆成了几个具体场景:离线信号去噪、实时音频去噪、图像去噪、CT 图像重建,以及能效预测。这个选择很聪明,因为它既覆盖了一维信号,也覆盖了二维图像,还碰到了逆问题多输出回归。也就是说,它不是挑一个最容易的 demo 讲故事,而是试图证明这个框架有一定通用性。

理论保证,不只是快

很多近似方法的问题都很像:跑得是快了,可理论上像“蒙的”。这篇论文比较讨喜的一点,是它没有停在工程优化上,而是认真分析了 Nyström 子采样在向量值回归中的收敛性。论文给出的不是“看起来差不多”,而是最小极大最优收敛率(minimax-optimal convergence rates)。
这个术语可以拆开看。最小极大的意思是:在一类最坏情况里,算法表现已经接近理论上能达到的最好水平;收敛率说的是样本越来越多时,误差下降得有多快。换句话说,作者不是只证明“能收敛”,而是证明“收敛得还挺漂亮”。这就像不是只会跑,还能跑进前排。
理论分析里最值得注意的是它使用了更一般的源条件。很多经典工作只讨论 Hölder 型条件,或者 operator-monotone 这类较特殊的假设;而本文引入的是由 index function 描述的通用源条件。这里的 index function 可以理解为刻画目标函数“有多光滑”的一把尺子,尺度更灵活,能把多种传统假设统一起来。这样一来,理论不再只适用于“教科书式的理想情况”,覆盖面更广。
论文还讨论了一个很关键的条件:Tikhonov 正则化的“资格”是否覆盖某个 index function。Tikhonov 正则化就是在经验风险后面加一项范数惩罚,防止模型把训练集记成死记硬背的“学霸笔记”。资格覆盖则表示这种正则方式足够表达目标函数的平滑度要求。听上去像理论细节,实际上决定了误差界能不能成立。
更进一步,在额外假设特征值满足多项式衰减时,论文把误差率推到了与已有最优结果一致的水平。这个结论很重要,因为它说明 Nyström 近似不是“为了快,牺牲一点点理论也没关系”,而是速度和统计效率可以同时兼顾。对于一个近似算法来说,能做到这一步,已经相当能打。

实验表现:均衡性能与效率

实验部分的思路很清楚:先看 Nyström 近似会不会把效果“近似没了”,再看它到底能省多少计算资源。论文使用的是高斯核,并在多个任务上与 full KRR 进行比较。这里的 full KRR 就是完整核岭回归,作为性能上限参照;Nyström KRR 则是子采样近似版本。对比对象里还出现了 BM3D 和 DnCNN,说明作者并不满足于只和自己比,而是把传统方法和深度方法也拉进来一起看。
表1:不同 m 下 Full KRR 与 Nyström KRR 在 MSE、信噪比增益和计算时间上的比较
表1:不同 m 下 Full KRR 与 Nyström KRR 在 MSE、信噪比增益和计算时间上的比较。最直观的现象是:m 越大,Nyström 越接近 full KRR,但计算时间也会随之上升;m 太小则快是快了,误差也会跟着冒头。
离线信号去噪里,Nyström 近似在 m=150 时已经非常接近 full KRR,说明低秩近似并没有把信号的主要结构打散。更有意思的是,m 从较小值逐步增大时,MSE 下降、SNR 增益上升,这种趋势非常符合直觉:代表点越多,骨架越完整,恢复出来的信号就越像原始核方法。与此同时,预测时间则明显更低,体现出近似法的工程优势。
图4:m 与 RMSE 的关系曲线
图4:m 与 RMSE 的关系曲线。这个图很像在提醒读者:Nyström 不是越省越好,得在“近似精度”和“计算成本”之间找一个甜点区间。
实时音频去噪尤其能体现这类方法的价值。流式场景里,模型不能等整段音频都到齐再慢悠悠处理,而是要边来边算。Nyström 近似在这里的意义非常实在:把“能不能算完”变成“能不能实时算完”。论文的结果显示,它在保持较好去噪质量的同时,能显著缩短单段预测开销,这对在线音频、边缘设备和交互式系统都很友好。
图2:高斯噪声下,KRR、Nyström 近似、BM3D 和 DnCNN 的重建结果对比
图2:高斯噪声下,KRR、Nyström 近似、BM3D 和 DnCNN 的重建结果对比。图像里最怕的不是噪声,而是“去噪之后一片塑料感”,而这里 Nyström 近似的结果基本保住了结构轮廓。
图像去噪部分也很有说服力。无论是运动模糊还是高斯噪声,Nyström 近似都能给出与 full KRR 接近的重建效果。和 BM3D、DnCNN 这些经典方法相比,核方法的优势在于它更像一个统一的算子学习框架,不需要为不同噪声类型单独设计太多花活。代价当然是计算量更高,但 Nyström 恰好把这个短板补上了一截。
表2:不同 m 下 Full KRR 与 Nyström KRR 在 MSE、信噪比增益和计算时间上的比较
表2:不同 m 下 Full KRR 与 Nyström KRR 在 MSE、信噪比增益和计算时间上的比较。这里的重点不是某个单点数值,而是趋势本身:近似做得越认真,性能越稳,代价也越高,典型的工程平衡题。
CT 重建和能效预测则补上了“不是所有任务都长得像去噪”这一点。前者是典型逆问题,后者则是普通回归任务。实验显示,这个框架并不局限于某一种输入输出形式,而是可以在功能上迁移到不同的结构化预测任务中。换句话说,它的卖点不是某一个特定数据集上的花哨分数,而是方法论层面的通用性
表4:运动模糊条件下的图像重建结果
表4:运动模糊条件下的图像重建结果。运动模糊往往最容易把边缘拖成“毛边”,而核近似方法仍能维持较平滑的恢复效果。
表5:高斯噪声条件下的图像重建结果
表5:高斯噪声条件下的图像重建结果。高斯噪声属于最常见也最“烦人”的那类扰动,结果说明 Nyström 近似并没有因为压缩模型而把图像细节一并压缩掉。
综合这些实验,可以得到一个比较稳妥的判断:Nyström 近似在这篇论文里不是“为了省算力凑数”的配角,而是能真正撑起效果与效率平衡的主角之一。尤其在 m 适中时,它几乎可以把 full KRR 的表现保住,同时把计算成本压下去一大截。对于实际应用来说,这种“少算很多、少掉不多”的方案,显然比单纯追求极致精度更有现实意义。

总结与启示

这篇论文的价值,主要不在于“发明了一个全新去噪器”,而在于它把Nyström 子采样向量值核学习去噪应用三件事拧成了一股绳。它证明了一个很实用的思路:当模型结构已经比较成熟时,提升可扩展性未必需要推倒重来,对计算瓶颈做结构化近似,往往就是最划算的路子。
从写论文的角度看,这类工作也很值得借鉴。第一,先把理论框架讲清楚,再把近似方法塞进去,逻辑会非常顺。第二,实验不要只盯单一任务,尽量覆盖不同输入输出形态,这样才能说明方法不是“只会在一个坑里跳舞”。第三,若方法的核心卖点是效率,最好把时间、内存和精度一起讲,不然读者很容易怀疑:快是快了,快到哪儿去了?
不过,Nyström 近似也不是万能钥匙。它依赖子采样质量,也依赖 m 的选择;如果任务本身极其复杂,或者数据分布变化很大,低秩近似未必总能稳稳命中最优点。也就是说,这套方法更像一把锋利但要会用的刀,而不是“拿来就能无脑切菜”的神器。

龙迷三问

下面是龙哥对于大家可能的一些问题的解答:

这篇论文到底解决了什么问题?它解决的是“核方法在向量值回归和去噪任务里太慢”的问题。论文用 Nyström 子采样把大核矩阵近似成低秩结构,在尽量保留精度的前提下,显著降低了时间和存储开销。

vRKHS 和标量核回归有什么区别?vRKHS 是向量值再生核希尔伯特空间,输出可以是函数、波形、图像等结构化对象;标量核回归通常只预测一个数。前者更适合算子学习和去噪这类“输出不是一个标量”的任务。

为什么论文强调一般源条件和最小极大最优收敛率?因为这说明方法不只是“能用”,而是“在理论上也够强”。一般源条件让假设更宽,最小极大最优收敛率则说明算法在统计意义上已经接近理论极限,不是随便拼出来的近似。

如果你还有哪些想要了解的,欢迎在评论区留言或者讨论~

龙哥点评

论文创新性分数:★★★☆☆。Nyström 本身不是新东西,但把它系统地放进向量值回归和算子学习框架里,并给出一般源条件下的理论分析,还是有实打实的增量。

实验合理度:★★★★☆。实验覆盖了信号、音频、图像、CT 和回归任务,能较好说明方法的通用性;不过部分结论仍然依赖 m 的选择,属于合理但并非“无脑稳赢”。

学术研究价值:★★★★☆。理论和应用都兼顾,尤其对向量值核方法的可扩展性研究有补位意义,适合后续继续往更复杂算子学习场景推进。

稳定性:★★★☆☆。在合适的子采样规模下表现不错,但近似质量受 m 和采样策略影响,离“随便一抽都稳”还有距离。

适应性以及泛化能力:★★★★☆。从多种去噪和预测任务的结果看,框架适配面较广,尤其适合输出结构化对象的场景。

硬件需求及成本:★★★★☆。相比 full KRR 明显更省,但仍然是核方法体系,规模再继续放大时也不能完全当成轻量模型看待。

复现难度:★★★☆☆。理论推导偏多,工程实现不算离谱,但需要对核方法、vRKHS 和 Nyström 近似都有一定理解。

产品化成熟度:★★★☆☆。在中等规模、对精度和可解释性有要求的去噪或逆问题里可用,但要上超大规模实时系统,还得进一步做工程优化。

可能的问题:方法依赖子采样质量和参数选择,若数据分布复杂或规模继续膨胀,近似误差和计算优势之间的平衡会更难拿捏。


主要参考文献

Naveen Gupta, Vaibhav Silmana, S. Sivananthan. Scalable Operator Learning via Nyström Approximation with Denoising Applications. arXiv:2606.26652v1, 2026.
B. Schölkopf, A. J. Smola. Learning with Kernels. MIT Press, 2002.
A. Caponnetto, E. De Vito. Optimal rates for the regularized least-squares algorithm. Foundations of Computational Mathematics, 2007.
A. Rudi, L. Rosasco, G. C. De Vito. Regularization learning with Nyström method. Journal of Machine Learning Research, 2015.
M. Meunier et al. Operator learning with general multiplicative kernels. 2024.

end
欢迎加入龙哥读论文粉丝群,扫描下方二维码或者添加龙哥助手微信号加群:kangjinlonghelper。一定要备注:研究方向+地点+学校/公司+昵称(如 图像处理+上海+清华+龙哥),根据格式备注,可更快被通过且邀请进群。
『龙哥读论文』微信群目前包含:图像处理、大模型及智能体、自动驾驶及机器人、AI医疗及AI金融5个群
wechat_helperdianzan
转发文章 微博 X LinkedIn Facebook
龙哥读论文 · PaperDaily

本文基于龙哥读论文 PaperDaily 数据库整理,结合论文原文与工程视角进行解读。