LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12823 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:人工智能

共 671 篇
AI · PAPER
大模型与智能体

TESS+Transformer+VAE:微透镜搜索新范式,持续时长预测R²=0.97

微引力透镜事件几百万颗恒星里才出一个,传统拟合方法扫一遍要跑到天荒地老。本文把Transformer和变分自编码器(VAE)结合起来,在TESS巡天数据上做了一次漂亮的“物理信息深度学习”示范。模型在560万条光变曲线上扫描,确认了92.7%的已知微透镜事件,还能直接预测事件持续时间,R²达到0.97。更难得的是,作者把模型在OGLE、MOA、KMTNet三

布里斯托大学新证明:陡峭势能下,不靠梯度的RWM反而更稳?
大模型与智能体

布里斯托大学新证明:陡峭势能下,不靠梯度的RWM反而更稳?

采样理论经常被“全局Lipschitz梯度”困住,只能处理二次势能。这篇论文提出曲率-力剖面假设,证明不依赖梯度的随机游走Metropolis在陡峭势能下依然能保持均匀接受率,还给出一套显式的提议尺度公式,把一大类超二次、指数和非凸势能都纳入了可定量分析的范畴。

李飞飞参与,斯坦福&Google新作:让VLM当裁判,图像压缩更懂人眼
视觉与图像

李飞飞参与,斯坦福&Google新作:让VLM当裁判,图像压缩更懂人眼

这篇论文把“谁来判断压缩图像好不好”这个老问题翻出了新花样。斯坦福和谷歌团队发现,Gemini 2.5-Flash这类通用视觉语言模型,竟然能零样本复现人眼的相似度判断,干脆把它请来当裁判,用偏好优化把扩散自编码器训得更懂人眼。结果在多个基准和上万次用户评测里直接干到第一梯队。想看看VLM怎么当评委、这条路能省多少人工标注成本?这篇值得一读。

MIT数学家破译高斯消元增长上限,稀疏奇迹破灭
视觉与图像

MIT数学家破译高斯消元增长上限,稀疏奇迹破灭

一篇彻底改写数值分析教科书认知的硬核理论成果。作者证明了完全主元与车房主元下高斯消元增长因子的渐近量级为维度拟多项式,解开了自1940年代延续至今的著名开放问题;同时证明稀疏矩阵下部分主元依然可能指数爆炸,寻找最优行置换还是NP难问题。做科学计算底层和数值算法的读者,这篇值得精读。

以色列理工最新研究:游泳机器人最优步态,被庞特里亚金算明白了
视觉与图像

以色列理工最新研究:游泳机器人最优步态,被庞特里亚金算明白了

想象一下在蜂蜜里游泳:你拼命划水,水却像胶水一样黏着你,一停就立刻静止。这就是低雷诺数世界里的真实日常。以色列理工学院这篇新论文,给经典的Purcell三连杆游泳机器人加了一个“大肚子”模型,再用庞特里亚金最大值原理,把“怎么扭最远、怎么扭最省力”的最优步态一次算明白了。

模拟存内计算秒变“猪队友”?北大港大出手:只调一个引导参数,扩散模型FID狂降75%!
视觉与图像

模拟存内计算秒变“猪队友”?北大港大出手:只调一个引导参数,扩散模型FID狂降75%!

模拟存内计算(CIM)部署扩散模型是低功耗生成的重要路径,但芯片非理想性会让引导信号悄悄“失真”。这篇北大港大合作的工作把失效通道定位到无分类器引导残差上,并给出免重训练、只改一个标量参数的优雅修复方案,在3个扩散模型上大幅恢复生成质量,值得所有关注AI芯片落地和扩散模型的读者一读。

无人机+智能反射面=移动“防窃听盾牌”,东南大学最新仿真
大模型与智能体

无人机+智能反射面=移动“防窃听盾牌”,东南大学最新仿真

6G通感一体化(ISAC)系统天生面临一个尴尬:用于感知目标的信号,也可能被目标“偷听”。东南大学团队将智能反射面(IRS)搬上无人机,并赋予其六维自由度(三维平移+三维旋转),通过让反射面在空中“转身挪窝”,在低空视距场景下显著提升保密速率,让窃听者“失聪”。本文拆解该工作的核心思路与算法设计,对无线通信、物理层安全、IRS方向的研究者很有参考价值。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球