LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12823 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

视觉与图像

共 717 篇
医学分割新范式:把JEPA搬进KAN函数空间,UUEKAN也被甩开
视觉与图像

医学分割新范式:把JEPA搬进KAN函数空间,UUEKAN也被甩开

KAN架构虽然把可学习的函数搬到了每条边上,但训练时却只盯着聚合后的节点输出,边函数本身一直缺一个直接的优化目标。哈工大与港大这篇FS-JEPA,直接把自监督预测学习搬进了KAN聚合前的函数空间,用多半径签名当预测目标,把最强KAN方法平均Dice拉高2.25个百分点,思路清奇又扎实。

图像配准|仅2分钟+零真值,韩国团队让3D大模型位姿、深度更准更一致
视觉与图像

图像配准|仅2分钟+零真值,韩国团队让3D大模型位姿、深度更准更一致

VGGT、DA3这类3D视觉基础模型,前向一次就能出位姿、深度和点云,但训练时没做显式多视角几何约束,结果经常“自相矛盾”。本方法把特征匹配得到的2D像素对应点当作伪真值,在测试时给模型补上显式几何约束,单场景最快2分钟完成自适应,6个模型、4个数据集位姿与几何估计全部一致提升,主打一个即插即用。

AI · PAPER
视觉与图像

美团&南信大新框架RAGSieve:RAG投毒攻击成功率67.4%→14.0%

RAG系统的知识库就像一面可以随时被外人涂改的墙——只要往里面塞几篇精心构造的文档,AI助手就可能一本正经地输出攻击者想要的错误答案。南京信息工程大学与美团提出RAGSieve,不给模型加补丁、不依赖干净语料库,而是用“自己身边的检索结果”当参照物,把攻击成功率从67.4%压到14.0%。

ECR 2026新研究:扩散模型给CBCT做"翻译",FDK重建输入让合成CT质量飙升20dB
视觉与图像

ECR 2026新研究:扩散模型给CBCT做"翻译",FDK重建输入让合成CT质量飙升20dB

放疗中反复CT辐射剂量高,低剂量CBCT图像质量又不够用?这篇ECR 2026论文用条件扩散模型做CBCT到CT合成,还专门较真了“输入图像怎么表示”这件事——结果发现,看似更粗糙的FDK重建反而能让扩散模型发挥更大潜力,PSNR相对提升超过20dB,思路很值得借鉴。

水下照片不再蓝绿蒙蒙?这个合成数据让特征匹配暴涨近7倍
视觉与图像

水下照片不再蓝绿蒙蒙?这个合成数据让特征匹配暴涨近7倍

水下照片总是蓝绿蒙蒙一片?印度理工学院这次把海洋光学的"家底"全搬进了合成数据——十种Jerlov水体、深度依赖辐照度、生物荧光一次建模到位。合成数据FID比最强竞品直降46%,四个增强架构跨六个真实数据集全面反超。搞水下视觉的朋友,这份物理知识+数据工程的双拼值得仔细品品。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球