LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1655 篇文章

PaperDaily 数据库收录 论文拆解 12858 研究思路 385 AI 资讯 210 开源项目 164 科研招聘 128 学习资料 8 热点主题 503 论文成功模式 1625

大模型与智能体

共 812 篇
AI · PAPER
大模型与智能体

GPT-5.4也翻车?港科大(广州)新基准:长文档重建关系数据库,F1仅75

当业界还在用单表抽取评测文档理解时,港科大(广州)团队直接抬高了门槛——Doc2DB-Bench要求从长文档里重建完整的关系数据库,边从表格到数据库:为什么文档理解需要新范式 先看一个真实场景:一份几十页的金融报告,里面写了好几家公司的现金流数据、股权关系、投资链路。传统做法是让大模型把里面的公司名称、金额、年份挨个抠出来,填进一张大表里完事。

银粉热桥立功!块体NbTi首次踏入超导雪崩过渡区
大模型与智能体

银粉热桥立功!块体NbTi首次踏入超导雪崩过渡区

超导雪崩就像个暴脾气,说翻脸就翻脸。波兰科学院往块体铌钛超导盘的界面层里掺了点银粉,雪崩阈值随温度的变化规律直接“反着走”——非单调、有峰值,而且现有准静态理论居然算不出这个结果。超导稳定性控制,又多了一个新抓手。

浙大葛根年团队新突破:加权硬核模型让球覆盖下界提升d倍
大模型与智能体

浙大葛根年团队新突破:加权硬核模型让球覆盖下界提升d倍

先抛一个小问题:如果地上摆满了大小完全一样的西瓜,只能挑、不能挪,挑出来的西瓜还得两两互不挨着——那么最多能挑走总体积的几成?这事儿放到高维空间里,数学家从1928年断断续续想到现在,连个像样的下界都差点意思。最近,一篇论文用统计物理里的“硬核模型”,把这个困扰近百年的几何难题往前大幅推进:下界直接从一个常数因子翻到了维度因子d。这不是挤牙膏式的优化,而是把

40岁数学难题被他用"词对分解"一招终结,Ross猜想的最后一块拼图
大模型与智能体

40岁数学难题被他用"词对分解"一招终结,Ross猜想的最后一块拼图

如果有一个目标在碰运气式的“两房间”里来回躲藏,搜索者每次只能查一个房间,而且即使查对了房间也可能看走眼——这种情况下,搜索策略的最终形态到底是怎样的?这个问题听起来像抓猫,其实是运筹学与随机控制领域里一个流传了四十多年的经典难题: Ross猜想 。本文用一个极其漂亮的“词对分解+射影几何”组合,把最后一块未证的拼图补上了。

Google+UC Berkeley新作:ArchAgent v2自动进化三级预取器
大模型与智能体

Google+UC Berkeley新作:ArchAgent v2自动进化三级预取器

预取器是芯片里的“预言家”,过去全靠人类工程师手搓,如今Google联合UC Berkeley让LLM进化智能体自己“进化”出一个三级预取器,直接拿下DPC4冠军,IPC比人类顶级方案还高0.3%,低带宽场景下更是领先2%。这是AI自动硬件设计第一次真正在权威竞赛里赢过人类冠军,值得所有做体系结构和AI的人围观。

这哥们用开源代码推翻了编码理论16年的著名猜想
大模型与智能体

这哥们用开源代码推翻了编码理论16年的著名猜想

编码理论里有个著名的Etzion–Silberstein猜想,断言一种“容量上界”总能被精确顶到。结果这篇论文用计算机穷举加精确约化,把一个12维的上界硬生生压到11维——差距只有1,但猜想已经凉透。更难得的是作者把验证包全部开源,任何人可复核,这种做事方式龙哥很欣赏。

南洋理工最新:AI代理“自我投毒”,93%成功率绕过所有防御
大模型与智能体

南洋理工最新:AI代理“自我投毒”,93%成功率绕过所有防御

这可能是第一篇系统研究“AI代理自我投毒”的论文:攻击者不注入任何恶意外部输入,只靠模型自己在正常任务里“写”出带毒的技能文件,就能让隐私泄露、提权、越权写入在后续任务中自动触发,在OpenClaw、Codex、Claude Code上平均攻击成功率超93%。对做AI Agent安全和部署的同学来说,这篇值得细读。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球