LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12809 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:NLP

共 33 篇
IBM提出GradeSQL:Text-to-SQL测试时验证提升4.33%
大模型与智能体

IBM提出GradeSQL:Text-to-SQL测试时验证提升4.33%

Text-to-SQL 最怕的不是“写不出来”,而是“写出来也不一定对”。这篇论文把验证器搬到测试时,用学出来的语义打分替代拍脑袋规则,思路很朴素,但确实更像工程上能落地的解法。

Apple最新研究:10个标注员就够了!KL散度饱和曲线给出标注预算最优解
大模型与智能体

Apple最新研究:10个标注员就够了!KL散度饱和曲线给出标注预算最优解

苹果最新研究揭示了一个没人细想过的问题:收集标注时,花了钱不等于拿到了“对”的信息。KL散度和熵相关性对标注数量的要求天差地别。更扎心的是,免费的标签平滑无法取代标注员提供的“物品特有不确定性”信号。这篇文章会让你重新思考数据标注的预算分配,获得实实在在的降本增效理论基础。

被引26489次!蒙特利尔大学提出RNN编码器-解码器:给机器翻译装上“语义引擎”
大模型与智能体

被引26489次!蒙特利尔大学提出RNN编码器-解码器:给机器翻译装上“语义引擎”

这篇论文是NLP领域圣经级的存在,引用数高达26489次!它提出的RNN编码器-解码器架构,以及其中巧妙的门控隐藏单元,直接为后来风靡全球的seq2seq模型和GRU铺平了道路。如果你想理解机器翻译乃至整个序列生成任务的基石,这篇2014年的经典之作绝对不容错过。

西北工大开源SenFlow:重构句子级AI文本检测,跨域泛化涨4.15%
大模型与智能体

西北工大开源SenFlow:重构句子级AI文本检测,跨域泛化涨4.15%

继6月聊过AI文本检测“水土不服”后,这次西北工业大学团队直接把问题搬到了句子级别:一篇论文里哪些句子是人写的、哪些是AI写的?SenFlow独创“句间流建模”,像侦探看“作案轨迹”一样分析句子间的写作模式,跨域迁移成绩涨4.15%。更关键是,它连DeepSeek-V3.2这种“伪装高手”都能揪出来,有意思。

伦敦国王学院最新研究:给扩散LLM解码装上“锚点”,精度飙升6.4%,速度狂飙7.2倍!
大模型与智能体

伦敦国王学院最新研究:给扩散LLM解码装上“锚点”,精度飙升6.4%,速度狂飙7.2倍!

扩散大模型并行解码虽快,但“一锅粥”式的上下文让错误像雪球一样越滚越大。伦敦国王学院这篇论文,巧妙地提出了一种无需训练的“锚点”机制,像给混乱的生成过程立了个不倒的“路标”,让模型在嵌入空间里就能“拨乱反正”,效果拔群。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球