LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12851 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

大模型与智能体

共 785 篇
浙大葛根年团队新突破:加权硬核模型让球覆盖下界提升d倍
大模型与智能体

浙大葛根年团队新突破:加权硬核模型让球覆盖下界提升d倍

先抛一个小问题:如果地上摆满了大小完全一样的西瓜,只能挑、不能挪,挑出来的西瓜还得两两互不挨着——那么最多能挑走总体积的几成?这事儿放到高维空间里,数学家从1928年断断续续想到现在,连个像样的下界都差点意思。最近,一篇论文用统计物理里的“硬核模型”,把这个困扰近百年的几何难题往前大幅推进:下界直接从一个常数因子翻到了维度因子d。这不是挤牙膏式的优化,而是把

40岁数学难题被他用"词对分解"一招终结,Ross猜想的最后一块拼图
大模型与智能体

40岁数学难题被他用"词对分解"一招终结,Ross猜想的最后一块拼图

如果有一个目标在碰运气式的“两房间”里来回躲藏,搜索者每次只能查一个房间,而且即使查对了房间也可能看走眼——这种情况下,搜索策略的最终形态到底是怎样的?这个问题听起来像抓猫,其实是运筹学与随机控制领域里一个流传了四十多年的经典难题: Ross猜想 。本文用一个极其漂亮的“词对分解+射影几何”组合,把最后一块未证的拼图补上了。

Google+UC Berkeley新作:ArchAgent v2自动进化三级预取器
大模型与智能体

Google+UC Berkeley新作:ArchAgent v2自动进化三级预取器

预取器是芯片里的“预言家”,过去全靠人类工程师手搓,如今Google联合UC Berkeley让LLM进化智能体自己“进化”出一个三级预取器,直接拿下DPC4冠军,IPC比人类顶级方案还高0.3%,低带宽场景下更是领先2%。这是AI自动硬件设计第一次真正在权威竞赛里赢过人类冠军,值得所有做体系结构和AI的人围观。

这哥们用开源代码推翻了编码理论16年的著名猜想
大模型与智能体

这哥们用开源代码推翻了编码理论16年的著名猜想

编码理论里有个著名的Etzion–Silberstein猜想,断言一种“容量上界”总能被精确顶到。结果这篇论文用计算机穷举加精确约化,把一个12维的上界硬生生压到11维——差距只有1,但猜想已经凉透。更难得的是作者把验证包全部开源,任何人可复核,这种做事方式龙哥很欣赏。

南洋理工最新:AI代理“自我投毒”,93%成功率绕过所有防御
大模型与智能体

南洋理工最新:AI代理“自我投毒”,93%成功率绕过所有防御

这可能是第一篇系统研究“AI代理自我投毒”的论文:攻击者不注入任何恶意外部输入,只靠模型自己在正常任务里“写”出带毒的技能文件,就能让隐私泄露、提权、越权写入在后续任务中自动触发,在OpenClaw、Codex、Claude Code上平均攻击成功率超93%。对做AI Agent安全和部署的同学来说,这篇值得细读。

印度团队出手:让AI Agent"不敢乱动",F1 88.5%还能全员验证
大模型与智能体

印度团队出手:让AI Agent"不敢乱动",F1 88.5%还能全员验证

给AI代理发工具权限就像借车给实习生——怕他乱开。Niyam-AI直接上密码学“行车记录仪+电子围栏”:每次工具调用都得先过轻量Judge模型,再生成零知识证明,F1 88.5%、误报率仅1.1%,关键是任何第三方都能在53毫秒内验证“安全检查真的发生了”。同类工作里把ZK证明用到agent工具调用验证上的,这是头一遭。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球