LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12787 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

最新文章

共 1573 篇
KAIST最新:AI整图重绘也能精准定位篡改,IoU达0.92
视觉与图像

KAIST最新:AI整图重绘也能精准定位篡改,IoU达0.92

当扩散模型把整张图都“重画”一遍,你还能看出哪里被改过吗?现有主动防篡改定位方法在“全再生”场景下集体崩盘,AUC直接掉到0.5左右。KAIST这篇APT论文第一个系统研究该问题,用潜空间锚点对齐扰动把FR场景定位IoU做到0.92,碾压最强基线WAM(0.84),且能泛化到未知篡改类型。想搞懂AI取证下一个赛点,这篇值得读。

东北大学开源RegionCache:多轮图像编辑最高提速2.55倍
视觉与图像

东北大学开源RegionCache:多轮图像编辑最高提速2.55倍

东北大学提出RegionCache,专治多轮图像编辑的重复计算病:连续编辑轮次中平均81%-92%区域根本不变,却每次都把整张图重新生成一遍。RegionCache用跨注意力把“没变的语义”映射到“没变的区域”,直接复用缓存隐藏状态,只重算真正被改的地方,在PixArt-α上拿到1.43-2.55倍端到端加速,画质基本不掉。有代码,值得跑一跑。

UW最新研究:VLM+MR给路痴导航,场景识别提升22%
视觉与图像

UW最新研究:VLM+MR给路痴导航,场景识别提升22%

方向感差不是智商问题,而是注意力投错了地方。这篇论文用20人的VR眼动实验抓出了路痴和认路高手的本质差异,再把这个差异翻译成VLM提示词,做成了混合现实导航系统——直接让场景识别率提升22%,地标回忆数量翻倍。导航软件终于开始考虑“让你记住路”而不是“替你走完路”了。

字节跳动UBASE:万亿向量检索吞吐3倍,内存直降80%
前沿研究

字节跳动UBASE:万亿向量检索吞吐3倍,内存直降80%

这不是又一棵刷榜的韭菜,而是字节跳动万亿级生产系统UBASE首次系统公开。它真正解决的是大模型时代最扎心的痛点:向量海量增长,内存和成本双双爆炸。吞吐3倍、索引内存降80%、成本降86%的硬核数据,值得每个搞RAG和向量检索的人细品。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球