LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12787 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

最新文章

共 1573 篇
同济新基准专治文生图“没文化”:GPT Image画隐喻也翻车,结构准确率仅78%
视觉与图像

同济新基准专治文生图“没文化”:GPT Image画隐喻也翻车,结构准确率仅78%

让AI画“时间就是金钱”,它可能真画一个挂满钞票的时钟;让AI画“知识就是力量”,它又可能把书本和哑铃硬拼在一起。文生图模型能把物体画得很真,却常常画不出“画外之音”。同济大学等机构提出VMetaphor-Bench,把“视觉隐喻生成”这件事第一次系统性地量化评测,结果连GPT Image 1.5也栽在结构组合上。

视频生成不懂物理?川大新框架用事件链思维,物理正确率暴涨至72.5%
视觉与图像

视频生成不懂物理?川大新框架用事件链思维,物理正确率暴涨至72.5%

大模型生成视频"看起来美,动起来假"的顽疾有解了。这篇来自四川大学的工作,不去堆算力,而是给视频生成装上"物理事件链"大脑,用可量化的物理公式约束每个中间状态,在PhyGenBench上把物理贴合度均值提升到72.5%,值得做视频生成与世界模型的朋友细读。

西南科大新研究:去掉文本Dice从91.61%暴跌至40.76%,医学图像分割真的离不开文字?
视觉与图像

西南科大新研究:去掉文本Dice从91.61%暴跌至40.76%,医学图像分割真的离不开文字?

每次看到给医学图像分割加文本引导的工作,龙哥都会问一句:那行文字到底起多大作用?这篇论文用5个预训练医学视觉语言模型和4种融合算子做了系统性交叉实验,还提出一个轻量诊断工具做证据解耦,把“换融合头不涨点、去文本却崩盘”这类反直觉现象掰开揉碎了讲清楚,值得做多模态医学影像的读者花几分钟细读。

6 fb⁻¹数据查完B_s⁰→D_s⁻π⁺,CPT完好如初
大模型与智能体

6 fb⁻¹数据查完B_s⁰→D_s⁻π⁺,CPT完好如初

粒子物理界的“对称性守门员”LHCb又出手了。这次他们用6 fb⁻¹的质子对撞数据,在B_s⁰介子衰变里把CPT与洛伦兹不变性的破缺上限往前推了一大截,灵敏度直达10⁻¹⁴ GeV量级。结果依然是“没破缺”——但这种没找到,恰恰是宇宙基本对称性依然坚挺的最好证据。硬核、干净、不浮躁,值得一读。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球