LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1672 篇文章

PaperDaily 数据库收录 论文拆解 12899 研究思路 385 AI 资讯 265 开源项目 164 科研招聘 131 学习资料 8 热点主题 509 论文成功模式 1625

最新文章

共 1672 篇
快慢双路径Mamba + D-βB门控,文档二值化新范式
视觉与图像

快慢双路径Mamba + D-βB门控,文档二值化新范式

每次遇到新档案馆里那些发黄、透墨、满是污渍的老旧文档,你是不是还得重新标注数据、重新微调模型?本论文的DR-Mamba让你彻底告别这个繁琐环节——它利用巧妙的快慢双路径Mamba和样本条件的自适应减法门,在模型前向推理时就能自动适应每张文档的独特退化类型,效果还特别能打,尤其对最难处理的极端退化样本效果拔群。

南方科技大学最新研究:室内占据预测告别体素分类,32个基元效果优于SOTA,速度3.7倍
视觉与图像

南方科技大学最新研究:室内占据预测告别体素分类,32个基元效果优于SOTA,速度3.7倍

室内占据预测,传统方法要么算得慢,要么基元浪费。南方科技大学这篇FLM-Occ,直接把问题换个角度定义——从分类变成估计分布,用最大似然训练。结果呢?只用32个基元,精度超越SplatSSC的1200个,速度还快了快4倍!这思路,有点东西。

中山大学最新研究:让自动驾驶先“脑补”未来,再“反思”轨迹,4B模型SOTA效果亮眼8B
视觉与图像

中山大学最新研究:让自动驾驶先“脑补”未来,再“反思”轨迹,4B模型SOTA效果亮眼8B

大多数自动驾驶模型都是“一条路走到黑”,直接生成轨迹,却不知道这轨迹未来会导出什么结果。中山大学等机构提出的IRR-Drive模型,让智能体先“预设意图”,再通过预测未来BEV可视化地“反思”一遍,最后才修正轨迹。这种做法在NAVSIM v1/v2两个权威榜单上都拿到SOTA,而且仅用4B参数就能干翻不少8B模型,性价比拉满。

Apple最新研究:10个标注员就够了!KL散度饱和曲线给出标注预算最优解
大模型与智能体

Apple最新研究:10个标注员就够了!KL散度饱和曲线给出标注预算最优解

苹果最新研究揭示了一个没人细想过的问题:收集标注时,花了钱不等于拿到了“对”的信息。KL散度和熵相关性对标注数量的要求天差地别。更扎心的是,免费的标签平滑无法取代标注员提供的“物品特有不确定性”信号。这篇文章会让你重新思考数据标注的预算分配,获得实实在在的降本增效理论基础。

图像压缩新范式:纯INR路线也能做到清晰无伪影,PaaF给出答案
视觉与图像

图像压缩新范式:纯INR路线也能做到清晰无伪影,PaaF给出答案

图像压缩领域又出新招,这次来自意大利卡塔尼亚大学的团队,把纯粹的隐式神经表示(INR)玩出了新高度。他们提出的PaaF,用一套自适应量化和自调制激活函数,让INR图像压缩在感知质量上大杀四方。LPIPS相比最强基线NIF再降39%,低码率下的细节还原更是甩开对手几条街。纯INR路线原来还藏着这么大潜力!

脑胶质瘤IDH突变预测:图像基础模型 vs 影像组学,到底谁更靠谱?
前沿研究

脑胶质瘤IDH突变预测:图像基础模型 vs 影像组学,到底谁更靠谱?

影像基础模型(比如专为MRI设计的)在预测脑胶质瘤IDH突变时,居然打不过一个基于影像组学的表格基础模型?瑞士伯尔尼大学团队的最新研究做了个扎心的对比:四个主流视觉基础模型轮番上阵,结果被TabPFN表格模型轻松反杀。是基础模型“水土不服”,还是“老”方法被低估了?这篇关于胶质瘤IDH预测的系统性基准研究,值得所有关注AI医疗落地的读者一看。

Yann LeCun参与,SkyJEPA:让四旋翼在潜空间预测,零样本仿真直飞现实世界!
视觉与图像

Yann LeCun参与,SkyJEPA:让四旋翼在潜空间预测,零样本仿真直飞现实世界!

Yann LeCun的JEPA思想终于上天了!这篇工作提出了第一个用于四旋翼实时控制的JEPA风格潜空间动力学模型SkyJEPA。它完全在仿真中通过域随机化训练,却能零样本迁移到现实世界,在户外飞行中跟踪误差降低近40%,换了桨叶、加了负载也不掉链子。想看世界模型怎么帮无人机“闭眼预测”的,这篇必读。

告别BMS困境!线性引力波在膨胀宇宙中的质量损失计算法
大模型与智能体

告别BMS困境!线性引力波在膨胀宇宙中的质量损失计算法

爱因斯坦的引力理论在宇宙学常数(暗能量)下遇到了一个尴尬问题:引力波带走的质量究竟怎么算?这篇论文从线性引力波入手,通过巧妙的多极矩截断,不仅重新定义了de Sitter时空的“质量”,还发现了引力波扫过后独特的“记忆效应”。理论物理爱好者千万别错过,这里不仅有公式推导的严谨,也有宇宙学尺度的奇思妙想。

何凯明团队最新BiFlow:告别万步自回归,归一化流一步生成FID 2.39
视觉与图像

何凯明团队最新BiFlow:告别万步自回归,归一化流一步生成FID 2.39

说起生成模型,大家最熟悉的可能是扩散模型(Diffusion Models)和自回归模型(Autoregressive Models),它们一个靠“慢慢去噪”做到高质量,一个靠“逐词预测”称霸语言。但还有一个老牌家族——归一化流(Normalizing Flows,简称NF),虽然理论优雅,却一度因为推理速度慢、架构受限,被很多人遗忘在角落。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球