澳门大学最新研究:对抗攻击1步就能防,白盒PSNR暴涨15dB
学习型图像压缩(LIC)性能虽猛,却怕对抗攻击——像素上加点人眼看不见的噪声,码率直接爆炸、画质稀碎。这篇澳门大学与南洋理工的最新研究发现了个反直觉的规律:攻破LIC要几百步,修复却只要1步!基于此提出的FTTR框架,在白盒攻击下把PSNR拉高近15dB,码率暴降6+。值得一读。
LONGGE AI RESEARCH DAILY
每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。
目前已发表 1655 篇文章
学习型图像压缩(LIC)性能虽猛,却怕对抗攻击——像素上加点人眼看不见的噪声,码率直接爆炸、画质稀碎。这篇澳门大学与南洋理工的最新研究发现了个反直觉的规律:攻破LIC要几百步,修复却只要1步!基于此提出的FTTR框架,在白盒攻击下把PSNR拉高近15dB,码率暴降6+。值得一读。
原子核就像一个挤满质子和中子的“小球宿舍”,核物理学家最关心的问题之一就是:这间宿舍到底有多大、质子住在哪一层。
等变模型是材料模拟的基石,但完整O(3)等变性长期被“自然奇偶校验”限制。本文用Wigner-6j重耦合与局部O(2)框架两板斧,将复杂度从O(L⁶)砍到O(L³),并首次系统支持非共线磁性——做力场和自旋模拟的读者不容错过。
AI医疗卷得飞起,但不少方案动辄几十G显存起步,医院看了直摇头。这篇格拉斯哥大学的工作反其道而行:用GTX 1070就能跑的四款经典CNN,把结直肠癌患者CT里的肌肉与脂肪指标自动算出来,误差低至4.96%,还顺手做了个网页工具。低成本落地范本,值得一读。
如果说机械臂是机器人的“手臂”,那灵巧手就是它的“指尖”——能抓鸡蛋、玩叠叠乐、拧瓶盖的那种指尖。但灵巧操作一直是机器人领域的老大难问题:机械臂在工厂里已经干了几十年活了,灵巧手却还在实验室里“装婴儿”。为啥?
人人都说AI要像人一样干活,可它连“等锅汤开要多久”都没概念。根特大学等机构推出Chronocooked强化学习基准,把时间藏在炒菜场景里,逼着智能体靠内在计时做决策。想看AI到底会不会“看表”,这篇论文值得一读。
CFG的八种免训练替代方法,真的比原版CFG更香吗?这篇论文在统一协议下,用组合对齐基准在SD3.5 Medium和FLUX.2 klein上实测,结论相当扎心:没有一个方法能全面胜出,CFG依然是性价比之王。想知道哪些方法在哪些指标上偷偷涨了点?这篇评测给你答案。
机器人学数据就像人类学做饭——光看不练不行,但真去采数据又贵又慢。华为这篇CVPR 2026工作VideoWeaver,直接把多视角演示视频"一键换肤":深度图加草图当控制信号,4D点云把不同视角的潜空间钉在同一坐标系里,跨视角风格终于不再各说各话。8张昇腾910B训一周,11B参数,效果还压过14B的VACE。
当大模型学会“思考”后,机器人也该学学“先想后做”了。本论文把大模型里的测试时计算扩展到了机器人子任务规划中,用世界模型预测、价值模型评分、束搜索择优,让机器人在面对长时程任务时不再“走一步算一步”。四项真实世界长时程任务平均成功率45%,值得所有做机器人决策的朋友读一读。
视频模型看懂动作却丢了空间结构,图像模型擅长几何却不懂运动——DeepMind用一套循环掩码自编码器RVM把两边的好处全占了,只靠像素重构损失,小模型还不需要蒸馏,参数效率最高领先30倍。这事儿有点意思,值得花三分钟读一读。
Apple Research出品,一份覆盖9个模型、11种训练语言、最多23种训练变体的大规模 GRPO 多语言实验。它用数据回答了「非英语推理训练到底行不行」这个老问题,还挖出了跨语言迁移背后的隐藏退化风险。做多语言强化学习或推理模型训练的同学,这份图谱值得收藏。
粒子物理界的“寻宝游戏”又有新斩获!BESIII合作组利用百亿级数据样本,首次观测到J/ψ和ψ(3686)衰变到Σ⁰Σ̄⁰η的稀有过程,直接检验粲偶素衰变中的12%规则。想了解粒子如何“变装”成超子对加介子?这篇带你一探究竟。
LONGGE AI COMMUNITY
加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。
加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。
微信扫码加入知识星球