LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12820 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:多模态

共 200 篇
7,147条样本实测:融合模型比单模态更稳
视觉与图像

7,147条样本实测:融合模型比单模态更稳

点击诱饵这事,最阴的地方不是“标题党”,而是标题和缩略图一起演戏。BanClickThumb把孟加拉语 YouTube 的这套“组合拳”做成了可复现基准,文本、图像、融合三条线一起比,结果很清楚:只看图不够,只看字也不稳,融合才更像正经干活。

不碰文本也能改记忆:LUCID揭开多模态智能体新漏洞
视觉与图像

不碰文本也能改记忆:LUCID揭开多模态智能体新漏洞

多模态智能体最怕的不是答错,而是把错的东西“记牢”。这篇论文直接把矛头对准长期记忆:攻击者只改一张图,就能在黑盒条件下把记忆系统带偏,而且五种后端都没能幸免。更关键的是,它把“检索被命中”和“模型真的信了”这两件事分开看,结论很扎实。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球