LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12823 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:大语言模型

共 319 篇
Apple Research最新论文 | ARBITRAGE:推理延迟降2倍,优势感知投机解码新范式
大模型与智能体

Apple Research最新论文 | ARBITRAGE:推理延迟降2倍,优势感知投机解码新范式

这篇论文把推测解码的老问题拆得很清楚:目标模型有相当比例的“重写”其实毫无价值,因为重写前后的推理步骤质量差不多,算力却要照付。ARBITRAGE直接用轻量路由器预估“这一步目标比草稿强多少”,只在真正有可能更优时才升级到目标模型,数学推理任务上端到端延迟最多降约2倍。

GPT-4.1给推荐系统暖启动:线上180万用户实测CTR涨9.51%
大模型与智能体

GPT-4.1给推荐系统暖启动:线上180万用户实测CTR涨9.51%

这篇来自NAVER WEBTOON的工业界论文,把大语言模型从“在线排序器”降级成了“离线先验估计器”,用GPT-4.1从评论文本里提炼贝叶斯先验给Thompson采样暖启动。真实线上A/B/C测试近180万用户,冷启动10-49印象桶CTR涨了9.51%,还顺手揭示了一个反直觉现象:内容先验降CTR却升CVR。想抄作业的做推荐的都该看看。

阿里&新国立最新研究:大模型对齐隐私泄露,32B照样能防住
大模型与智能体

阿里&新国立最新研究:大模型对齐隐私泄露,32B照样能防住

偏好数据是大模型对齐的燃料,但用户“喜欢什么”本身就是敏感信息。这篇来自新加坡国立大学与阿里集团的工作,精准定位DPO独有的隐私漏洞,提出只往“偏好轴”上加噪声就能锁定隐私的PrivDPO,还首次将严格隐私对齐做到了32B模型,工程上几乎零额外成本。隐私保护与模型效用兼得,值得一读。

视频生成|复旦快手新研究:同一个PE写两边,T2V多事件生成全面涨点
视觉与图像

视频生成|复旦快手新研究:同一个PE写两边,T2V多事件生成全面涨点

如果你在公众号里刷到过AI视频生成的翻车现场,大概率见过这种名场面:你明明输入的是“一只熊推开树桩、找到食物、抓住老鼠、吃掉它”,生成的视频里熊只做到了一半就停下来,甚至干脆把树桩忘了。这不能全怪视频生成模型“笨”。真…

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球