LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12851 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

大模型与智能体

共 785 篇
波恩大学新研究:一个特征让大模型「黑化」?错位率62%反超微调
大模型与智能体

波恩大学新研究:一个特征让大模型「黑化」?错位率62%反超微调

继6月拆过阿里的百万级SAE之后,这次德国波恩大学把SAE用到了更刺激的地方:给大模型的「黑化」行为做定位。团队发现微调时涌现的错位行为,其实由预训练阶段就存在的人格特征驱动——单个特征引导的错位率高达62%,反超微调本身的35%,还能一键「回正」。更反直觉的是:人类写的反派文本不足以诱导错位,AI自己生成的却可以。论文横跨可解释性、数据归因与AI安全,值得

NANOGrav最新研究:引力波背景各向异性敏感度被系统量化,最灵敏天空区域比最差区域灵敏2-3倍
大模型与智能体

NANOGrav最新研究:引力波背景各向异性敏感度被系统量化,最灵敏天空区域比最差区域灵敏2-3倍

把PTA各向异性搜索从"拍脑袋选天空区域"变成"可计算的标度律",还顺带推演了NANOGrav未来30年的敏感度走势——最反直觉的结论是:光延长观测时间,对提升各向异性敏感度几乎没用。继2026年7月聊过PTA似然偏差量化之后,这是该领域又一篇值得逐字读的硬核方法学工作。

AI · PAPER
大模型与智能体

AI教育故事翻车现场?德国高校实测:叙事清晰4.11分,连贯性仅2.92分

这篇论文没急着吹AI能写多好的教育故事,反而请了22位高校STEM被试真的玩当AI写故事:教育场景生成的质量瓶颈在哪里? “这故事写得挺顺,但怎么一到测验题就变得这么尴尬?” 这句话可以说是本论文读者最真实的反应。想象一下:一个AI自动生成的互动小说,故事讲得流畅透顶,玩家一路做选择、推进情节,到了关键时刻,突然跳出一个NPC,脸上的表情仿佛在说“来吧,先答

耶鲁最新研究:一张静态Hα图,AI就能预测星系周介质流向?
大模型与智能体

耶鲁最新研究:一张静态Hα图,AI就能预测星系周介质流向?

这期龙哥带来一篇典型的“AI for Science”概念验证:耶鲁大学团队把UNet用在天文观测上,仅输入一张星系周介质的Hα发射形态图,就能输出冷气体在天空平面上的二维速度场。这项工作将误差量化、噪声边界、模型局限交代得明明白白,是近期少见的完整而克制的工作,值得AI与天文交叉方向的读者花十分钟读完。

LHCb最新:首次测出D_s1(2536)三体衰变,近阈值奇特态证据浮现
大模型与智能体

LHCb最新:首次测出D_s1(2536)三体衰变,近阈值奇特态证据浮现

在粒子物理的世界里,有一种“考古”工作特别刺激,那就是寻找和研究奇特强子态。所谓奇特强子态,是指那些不能简单地用传统的夸克-反夸克(介子)或三夸克(重子)图像描述的粒子——它们可能是四夸克态、分子态,甚至是更复杂的混杂态。

多轮搜索Agent新范式:小模型蒸馏精炼上下文,性能逼近GPT-4
大模型与智能体

多轮搜索Agent新范式:小模型蒸馏精炼上下文,性能逼近GPT-4

搜索智能体总是"检索到答案却答不出来"?问题很可能出在上下文干扰。港中大等机构这篇研究系统地定位了干扰源——最新检索回来的文档,并设计了蒸馏式上下文精炼器,让智能体在"生成"之前先"精炼",可靠性和效率双双提升。看完这篇,对多轮搜索智能体的调优思路会有新的启发。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球