LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12823 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:AI应用

共 437 篇
代码生成|中科院大作:安全测试当规范,结构化反馈零回归修复80个
视觉与图像

代码生成|中科院大作:安全测试当规范,结构化反馈零回归修复80个

大模型生成的代码能跑就算完?一测就出安全漏洞的场面见过太多。这篇论文把安全测试当“可执行规范”提前塞给模型,2705条轨迹实测:隐藏的联合成功率平均涨19.3个百分点,但也有模型越看测试越翻车。机制级严谨、工程级实用,值得细读。

AI · PAPER
大模型与智能体

GPT-5.4也翻车?港科大(广州)新基准:长文档重建关系数据库,F1仅75

当业界还在用单表抽取评测文档理解时,港科大(广州)团队直接抬高了门槛——Doc2DB-Bench要求从长文档里重建完整的关系数据库,边从表格到数据库:为什么文档理解需要新范式 先看一个真实场景:一份几十页的金融报告,里面写了好几家公司的现金流数据、股权关系、投资链路。传统做法是让大模型把里面的公司名称、金额、年份挨个抠出来,填进一张大表里完事。

南洋理工最新:AI代理“自我投毒”,93%成功率绕过所有防御
大模型与智能体

南洋理工最新:AI代理“自我投毒”,93%成功率绕过所有防御

这可能是第一篇系统研究“AI代理自我投毒”的论文:攻击者不注入任何恶意外部输入,只靠模型自己在正常任务里“写”出带毒的技能文件,就能让隐私泄露、提权、越权写入在后续任务中自动触发,在OpenClaw、Codex、Claude Code上平均攻击成功率超93%。对做AI Agent安全和部署的同学来说,这篇值得细读。

ICSME 2026实证:VRT查出18.5%非样式缺陷
前沿研究

ICSME 2026实证:VRT查出18.5%非样式缺陷

视觉回归测试(VRT)天天在跑,可它对开发者讨论和合并流程到底有什么影响?这篇ICSME 2026实证研究挑出307个VRT关联PR,给出硬核数据:合并中位时间长3.8倍、评论多10倍、代码改动放大数倍,还挖出近两成非样式性缺陷。想搞懂VRT真实价值与工程代价的开发者,值得一读。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球