Gurobi新招:三人扑克从24小时压到1.16秒
多人不完全信息博弈最烦的地方,不是“有没有解”,而是“解明明在那儿,电脑却算到怀疑人生”。这篇论文给松弛变量和乘子变量补上有限界,直接把求解器的搜索空间勒紧,三人库恩扑克完整版本从24小时以上压到1.16秒,属于很实在的加速。
LONGGE AI RESEARCH DAILY
每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。
目前已发表 1655 篇文章
多人不完全信息博弈最烦的地方,不是“有没有解”,而是“解明明在那儿,电脑却算到怀疑人生”。这篇论文给松弛变量和乘子变量补上有限界,直接把求解器的搜索空间勒紧,三人库恩扑克完整版本从24小时以上压到1.16秒,属于很实在的加速。
这篇论文把“单个问题慢慢解”改成了“很多问题一起解”,而且还是在GPU上批量跑非线性规划。对机器人、轨迹优化和模型预测控制来说,这种吞吐量思路很实用,属于把优化器从老式单机房,直接拎进了GPU流水线。
这篇论文不跟你绕弯子,直接把“质子在金属里到底被屏蔽成啥样”这件事掰开揉碎。最有意思的是,它把接触哈特里能量拎出来当主角:线性响应在近场翻车,DFT和模型势才是真正的考场选手。
这篇论文把“跑者”和“阻挠者”的图上博弈讲得很清楚,树、单环图、无桥三次图、完全二分图、Sierpinski 图都被逐个拿来算破坏数。别看是纯数学,套路其实很像在图里玩“堵路游戏”,挺适合喜欢组合博弈和图论的读者。
这篇论文不聊“AI有多酷”,而是把镜头对准真正会被AI影响的人:社区里的成年人。它最有意思的地方在于,教育不是单向灌知识,而是和社区一起把问题问清楚。
57维灵巧手动作不是“大一点的控制”这么简单,传统把动作一把压成向量的做法,在这里开始露怯了。本文把动作拆成结构化 token,再配上局部+全局注入和语义分支,思路很清楚,效果也确实能打。
这篇论文把“选模型”从拍脑袋拉回到贝叶斯证据的正轨。更妙的是,它直接拿7个系外行星系统开刀,看看哪种偏心率、噪声和趋势模型更靠谱。
这篇 CoOL 很有意思:不靠距离、不算相似度,靠多个观察者“商量一致”来做聚类。更妙的是,它还把收敛监控、分布漂移检测一起打包了,属于那种思路怪,但讲得通的论文。
这篇论文把“只在一小块地方能算”的对偶幺正层级,补成了“整个时空都能算”的全对偶幺正层级。更妙的是,它不光讲理论,还真的给出了非平凡构造,属于那种看完会想说一句“这门子数学,真会整活”。
这篇论文最有意思的地方,不是它又造了一个代币标准,而是它试图把“仓储费、保险费、审计费”这些链下现实成本,老老实实写进链上规则里。对 RWA 和 DeFi 来说,这属于那种看起来朴素、其实很难缝好的活。
CAT-Q把“训练到位才能三元化”的老路,改成了更省钱的后训练方案。512个校准样本,就想把1.58位大模型做得又稳又准,思路很硬。
这篇 PhysRAG 很像给视频生成模型塞了个“物理常识外挂”:先把训练数据洗干净,再把物理参考视频检索进来,用可学习查询提炼成真正有用的先验。结果不是只会“看起来像”,而是开始“物理上像”。
LONGGE AI COMMUNITY
加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。
加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。
微信扫码加入知识星球