LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12823 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:大语言模型

共 319 篇
告别脏数据!亚马逊开源Data Turnstile,让0.6B模型逼近7倍大模型
视觉与图像

告别脏数据!亚马逊开源Data Turnstile,让0.6B模型逼近7倍大模型

这篇论文切中了AI智能体落地的一个真痛点:小模型工具调用能力弱,但可靠数据既贵又脏。Data Turnstile把整段对话拆成带校验的角色化有向无环图,用开源权重模型就能批量产出高质量函数调用数据。0.6B微调后BFCL直逼7倍大的Qwen3-4B,多轮电信任务1.7B直接超越32B——数据质量对小模型而言,就是胜负手。

AI · PAPER
大模型与智能体

浙大最新MoE研究:专家重叠却有效,39组实验打破“几何互补”神话

MoE大模型靠“多个专家干活”撑起千亿参数,但专家之间到底是分工还是打架?这篇来自浙江大学与香港理工大学的最新研究,用39组因子实验拆开了一个反常识真相:专家子空间严重重叠,路由却依然精准;被选中的专家确实更强,但真实上下文反而在“压价”它的优势——作者称之为“连贯重叠”。一句话:光看几何相似度,千万别急着下“冗余”结论。

AI · PAPER
大模型与智能体

百度等揭示投机解码"有损加速"陷阱:任务越难,质量掉得越狠!

大模型推理加速是刚需,但"放水"换速度的代价到底是什么?这篇来自百度等团队的工作把有损验证方法扒了个底朝天,用严谨实验揭示了一个反直觉结论:任务越难,截断式验证的质量掉得越狠。看完这篇,再也不敢随便用"有损加速"了。

AI · PAPER
视觉与图像

四大缩放维度首次系统对比:本地CUA堆算力不如“选对维度”

这篇来自汉阳大学的实证研究,把本地电脑使用代理的推理时扩展拆成上下文、时间、结构、并行四个维度逐项考察。结论有点反直觉:额外算力常常不是提升成功率,而是把失败模式从“死循环”改写成“假成功”。对做本地部署的团队来说,这是一份难得的避坑指南。

AI · PAPER
大模型与智能体

快手最新A/B:收入涨4.5%,推荐系统为何终于“会买”了?

推荐系统最怕“懂你”却“不会买”——意图清楚了,行动却掉链子。快手这篇工作把理解与行动分开建模,用反馈闭环让策略真正以效果说话:在线A/B测试收入+4.506%、广告价值+4.621%,在线推理时延却几乎零增加。工业级生成式推荐落地,值得细读。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球