Meta FAIR新作:AI科研智能体装上"预算管家",2/3算力追平24小时成绩
AI科研智能体缺的不是想法,而是算力。本文提出研究偏好模型(RPM),相当于给智能体装了个“预算管家”:在花GPU之前,先让LLM当评委挑选最有潜力的候选方案。AIRS-Bench上,用不到三分之二的算力就能追上无引导基线24小时的成绩,思路清晰,落地性强。
LONGGE AI RESEARCH DAILY
每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。
目前已发表 1573 篇文章
AI科研智能体缺的不是想法,而是算力。本文提出研究偏好模型(RPM),相当于给智能体装了个“预算管家”:在花GPU之前,先让LLM当评委挑选最有潜力的候选方案。AIRS-Bench上,用不到三分之二的算力就能追上无引导基线24小时的成绩,思路清晰,落地性强。
当Karpathy提出的Vibe Coding遇上代码审查,会擦出什么火花?这篇论文用Vibe Coding快速造了一个语音AI代码审查工具,还把它当"挑衅性原型"去研究开发者对AI反馈的信任与协作变化。方法不算深,但思路很妙,适合想低成本用AI做研究探针的同学读一读。
这可能是AI for Science里最优雅的“翻译题”之一:把一堆非线性太赫兹二维相干光谱扔给卷积神经网络,让它反推材料内部的自旋哈密顿参数。本文在稀土正铁氧体上做到D-M相互作用相对误差仅千分之一,还顺手把真实实验数据跑通了正向验证——值得一读。
这期聊一篇纯数学论文,主题是特征2下Specht模的平凡直和项分类。别看名字唬人,其实问题很直觉:对称群的"积木"里,什么时候会藏着一块最平凡的"1×1乐高"?Murphy解决了钩子情形,Collins-Dodge把一般情形问了出来,这篇论文用KLR分次一招封死:非钩子全灭。干净、完整、还顺手给了一个优雅的度数矛盾。
这是剑桥大学Ross King教授撰写的一篇AI for Science全景综述。Ross King正是历史上第一个全自动机器人科学家Adam的缔造者。这篇论文以亲历者视角,系统梳理了从DENDRAL到AlphaFold、再到AI Scientist的完整进化路径,并首次提出六级科学自主性框架。想看懂AI科学家的过去、现在与未来,这篇是绕不开的入口。
斯坦福Chelsea Finn团队的新作。机器人操作策略学会了但跑得慢,这工作直接给模仿学习加装一个强化学习训练的速度策略,不采新数据、不动原策略,在倒水、投掷等动态任务上提速超2.4倍,思路轻巧、实验扎实,值得一读。
Painlevé方程被称为“非线性特殊函数之王”,其tau函数长期只能形式定义。本文首次把q-Painlevé VI的tau函数写成严格可算的Fredholm行列式,还顺手披露了它与初始值空间上四条例外线的精确对应。可积系统与数学物理爱好者值得细读。
从PRG构造PRF,最少要调用几次底层生成器?这个问题悬了40年。本文用元归约范式给出了两个新下界:查询有界归约下,非自适应构造省不掉ω(n/log n)次调用;长输出PRF无论自不自适应都无处可躲。理论密码学爱好者,这篇值得细读。
把±1符号换成±1矩阵,一条下界从1/ε²直接升到d/ε²——南洋理工这波把ℓ_p子空间嵌入的下界补齐到近最优,而且灵感来源写着ChatGPT 5.6。既有硬核数学,又有AI协作的瓜,值得一读。
世界模型这两年火得发烫。无论是视频生成、机器人控制还是游戏AI,都指望它能学会在脑子里模拟真实世界的变化规律。可大伙儿慢慢发现一个尴尬现状:让世界模型在开放世界里随便"脑补"未来,它玩得挺欢;
黑洞旋转的能量能被"偷走"吗?LIGO-Virgo-KAGRA合作组用最新引力波数据,给传说中的超轻玻色子画了一张"禁区地图"。这可能是暗物质搜索的全新姿势。
一个困扰星系辐射传输领域26年的"账本不平"问题,被一个名为"伪颗粒"的概念巧妙破解——不靠调参数,靠把秒差距尺度的尘埃团块"降维"成微观颗粒。思路清奇、数据扎实,堪称天文建模界的一股清流。强烈推荐给对辐射传输、星系尘埃及复杂系统建模感兴趣的读者。
LONGGE AI COMMUNITY
加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。
加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。
微信扫码加入知识星球