LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1660 篇文章

PaperDaily 数据库收录 论文拆解 12889 研究思路 385 AI 资讯 225 开源项目 164 科研招聘 130 学习资料 8 热点主题 507 论文成功模式 1625

最新文章

共 1660 篇
博世新方法GUARD:机器人动作再丝滑也能提前揪出失败,未见任务AUC提升5.73%
前沿研究

博世新方法GUARD:机器人动作再丝滑也能提前揪出失败,未见任务AUC提升5.73%

机器人VLA看着很“聪明”,但动作头可能根本没在“看”任务证据——本论文用KV缓存反事实消融直接探测这种“假装接地气”,零改动即可在五个未见任务设置上把平均ROC-AUC推到88.84%,比最强运行时监控器高5.73个百分点。思路清奇、工程开销小,值得做机器人与自动驾驶的朋友细读。

阿里&新国立最新研究:大模型对齐隐私泄露,32B照样能防住
大模型与智能体

阿里&新国立最新研究:大模型对齐隐私泄露,32B照样能防住

偏好数据是大模型对齐的燃料,但用户“喜欢什么”本身就是敏感信息。这篇来自新加坡国立大学与阿里集团的工作,精准定位DPO独有的隐私漏洞,提出只往“偏好轴”上加噪声就能锁定隐私的PrivDPO,还首次将严格隐私对齐做到了32B模型,工程上几乎零额外成本。隐私保护与模型效用兼得,值得一读。

CMU等四校联手:可微分物理笔刷,让AI生成手写还能操控机器人直接写出来
视觉与图像

CMU等四校联手:可微分物理笔刷,让AI生成手写还能操控机器人直接写出来

想象一下,AI 不仅能模仿任何人的笔迹生成手写图片,还能把笔画轨迹直接发给机器人,让它拿着笔在纸上写出来——在线轨迹和离线图像向来是两条平行线,这篇来自 GIST、CMU、延世大学等机构的论文用一个六参数的可微分物理笔刷模型,硬是把它们捏成了同一件事。

AI · PAPER
视觉与图像

香港科技大学提出LiveLight:视频重光照首次实时化,交互式打光边播边调

实时移动光源,画面即刻响应——LiveLight 让视频重光照从『渲染后等待』变为『边播边调』。香港科技大学联合多家机构提出首个基于扩散模型的实时流式视频重光照框架,仅用4步采样跑出15.78FPS还把质量做到SOTA,视频编辑领域值得重点关注的方向性工作。

视频生成|复旦快手新研究:同一个PE写两边,T2V多事件生成全面涨点
视觉与图像

视频生成|复旦快手新研究:同一个PE写两边,T2V多事件生成全面涨点

如果你在公众号里刷到过AI视频生成的翻车现场,大概率见过这种名场面:你明明输入的是“一只熊推开树桩、找到食物、抓住老鼠、吃掉它”,生成的视频里熊只做到了一半就停下来,甚至干脆把树桩忘了。这不能全怪视频生成模型“笨”。真…

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球