LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12820 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

视觉与图像

共 717 篇
ECCV 2026南开新作:像素看不清?超像素来救!7M参数横扫雨雪雾
视觉与图像

ECCV 2026南开新作:像素看不清?超像素来救!7M参数横扫雨雪雾

恶劣天气下的图像恢复,难点从来不在“去除”而在“组织”——雨雪雾在空间上分布极不均匀,而现有状态空间模型(SSM)却用固定轨迹逐个像素扫描,总把语义冲突区域硬凑成一段。南开大学等机构提出SSR,把扫描粒度从像素提升到超像素,让状态沿着语义边界“顺流而下”,再配合区域级门控做通道校准,参数量仅7.05M,却在六个基准上刷新了SOTA。思路干净,性价比极高,值得

Yann LeCun新作|视频预训练算力暴降20倍,丢掉95%Token反而更强
视觉与图像

Yann LeCun新作|视频预训练算力暴降20倍,丢掉95%Token反而更强

Yann LeCun参与的最新视频预训练工作,把JEPA家族的防坍塌机制全砍了,只用单一编码器加SIGReg正则,预训练算力直接降到原来的二十分之一,甚至95%的token随机丢掉反而精度更高。视频预训练终于不再是算力大户的专属游戏,这篇值得所有做视觉自监督的读者细读。

告别一键硬修!SuperSharpen把盲去模糊变成“手动挡”,细节更真实
视觉与图像

告别一键硬修!SuperSharpen把盲去模糊变成“手动挡”,细节更真实

这篇工作把扩散模型去模糊从“一键生成”变成了“手动调档”,引入了类似音量旋钮的模糊度量(BM),让用户自己决定要锐化多少、生成多少细节。还实打实对比了ControlNet适配和全量微调两条路线,结论清晰,落地感强,值得做图像恢复和摄影后处理的朋友读一读。

卢森堡大学新研究:太空机器人没奖励信号也能自学修复,60分钟见效果
视觉与图像

卢森堡大学新研究:太空机器人没奖励信号也能自学修复,60分钟见效果

太空机器人一旦硬件故障,传统强化学习就抓瞎——因为真空中根本算不出奖励信号。卢森堡大学这篇工作把世界模型玩出了新高度:预训练阶段把奖励函数"记住"在隐空间里,部署后冻结奖励预测器、只更新转移动力学,60分钟无监督数据就能让机器人自我修复。三大任务、代码开源、效果诚实不吹牛,值得一读。

拒绝内卷!北大CVPR 2026新作ExtrinSplat:3D语义理解不嵌特征,存储直接砍到MB级
视觉与图像

拒绝内卷!北大CVPR 2026新作ExtrinSplat:3D语义理解不嵌特征,存储直接砍到MB级

3D高斯泼溅遇上开放词汇理解,过去大家往点云里硬塞特征,结果存储爆表、边界糊成一片。北大这篇CVPR 2026新作反其道而行,把几何和语义彻底解耦,用VLM生成文本假设做外置索引,直接让特征存储从GB级砍到MB级。思路清奇,落地极香,值得一读!

西交&中大MICCAI 2026:死后组织“生前还原”,专家盲选23.81%胜出
视觉与图像

西交&中大MICCAI 2026:死后组织“生前还原”,专家盲选23.81%胜出

法医病理误判的潜在风险,被一次脑洞大开的「图像翻译」给盯上了。本论文首次把薛定谔桥搬进死后自溶恢复,不搞像素级配对,直接学分布映射,还建了首个真实数据集AutoPath。更狠的是,它证明FID这类老牌指标在诊断场景里可能「帮倒忙」——专家盲评和滑片级诊断一致性,才是硬通货。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球