浙大开源24小时心电基准:GPT-5也翻车,微调后准确率99.7%
24小时动态心电(Holter)是诊断心律失常的金标准,但多模态大模型在超长时序信号面前几乎“失灵”。浙大等团队开源Holtercare-Bench基准与Holtercare-23K数据集,用信号-视频-文本三模态对齐,让GPT-5、Qwen3-VL等模型首次系统性接受“心电马拉松”考验——微调后时序定位准确率飙到99.7%,差距比想象中更大。
LONGGE AI RESEARCH DAILY
每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。
目前已发表 1655 篇文章
24小时动态心电(Holter)是诊断心律失常的金标准,但多模态大模型在超长时序信号面前几乎“失灵”。浙大等团队开源Holtercare-Bench基准与Holtercare-23K数据集,用信号-视频-文本三模态对齐,让GPT-5、Qwen3-VL等模型首次系统性接受“心电马拉松”考验——微调后时序定位准确率飙到99.7%,差距比想象中更大。
宇宙到底有多安静?2024年2月到2025年4月,美国国家科学基金会的甚大阵列(VLA)用COSMIC系统,在25到50GHz这个此前少有人探索的高频波段,捞出了196万个窄带候选信号。经过七重过滤,最终结果:零。没有找到外星人。但别急着失望——这套搜索系统本身,可能是人类迄今最认真的"宇宙级打捞"。
这篇论文把扩散模型里最"玄学"的分数网络,用小波基展开成了完全可解析的形式——不用梯度训练,闭式岭回归直接算出最优去噪器。更妙的是,三种相关性结构把"数据里哪些统计量最重要"变成了可量化的诊断工具。理解扩散模型内部机制,这篇值得一读。
当机器人灵巧手在仿真里“摸”东西时,最大的谎言就是:接触跟真实世界差不多。这篇来自UC San Diego与Amazon FAR的新作,请来了Pieter Abbeel坐镇,把触觉接触信息直接变成神经动力学的条件信号,用大规模仿真预训练+少量真实数据微调,把灵巧操作里最难搞的“接触不连续”问题治得服服帖帖。MSE最低压到0.0058,任务成功率从52.6%飙
康奈尔大学CVPR 2026新作,用电影解说视频自动构建8231个问答对,提出无参考评估新范式。结果发现GPT-4o、Claude 3.5等顶级模型看电影,视觉几乎帮不上忙,纯靠字幕反而分更高,值得所有做多模态的人细品。
这是一篇热度很高的纯数学新作。南开大学与思克莱德大学团队把“同时避开一个长度三经典模式与一个平偏序模式”的6ℓ对配置完整分类,顺手证明了Qiu-Remmel猜想,还修正了原文关键错误。最令人拍案的是:排除等价类居然动用了素数定理级别的数论工具,组合与数论在同一个舞台相遇。
一颗曾被高分辨率光谱仪捕捉到1.24%氦吸收的宜居带超级地球,在JWST四次凌星观测中全部"隐身",联合约束4.5σ否决持久信号。是天体在间歇性"喘气",还是恒星活动与视宁度效应联手制造了一场幻觉?这篇论文给了教科书级的科学证伪示范。
十几年没补上的充分必要条件鸿沟,被一道半定规划容量直接填平;纯数学里同时用上锥对偶和复Grothendieck不等式,还顺手把两个公开问题结案,这种“多重闭环”属实少见。
想象一个场景:你打算从一家创业公司跳槽去竞争对手那里,拿起手机问AI:“公司能强制执行我的竞业限制协议吗?”它几乎秒回:“竞业限制协议在合理范围内一般可执行,但需结合具体条款判断。
暗物质不仅塑造星系,还能帮黑洞“抽能”?这篇论文用Comisso-Asenjo磁重联机制证明:冷暗物质晕能把旋转黑洞能量提取的自旋门槛从0.86拉到0.25,功率还能反超Blandford-Znajek机制27倍。一句话,黑洞能量提取这门老手艺,在暗物质氛围里反而更好使了。
先说人话:这篇论文干了一件很“横”的事——把广义Fermat方程在p-adic世界里“有没有解”的概率,硬生生压缩成了关于三个最大公约数的有理函数。
论文由Sichen Pan和Simon Scheuring完成(通讯作者为Simon Scheuring),发表在Nature Communications上,提出了名为SPIDER(Scanning Probe Mic。
LONGGE AI COMMUNITY
加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。
加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。
微信扫码加入知识星球