LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1655 篇文章

PaperDaily 数据库收录 论文拆解 12859 研究思路 385 AI 资讯 210 开源项目 164 科研招聘 128 学习资料 8 热点主题 503 论文成功模式 1625

标签:AI应用

共 451 篇
佛蒙特大学用数据科学“拆解”《老友记》:剧情套路越多,评分越高?钱德勒果然最“尴尬”!
大模型与智能体

佛蒙特大学用数据科学“拆解”《老友记》:剧情套路越多,评分越高?钱德勒果然最“尴尬”!

当《老友记》遇上计算叙事学,这波跨界直接把我看呆了。佛蒙特大学团队没去搞图像识别,反而把“TVTropes”里的剧情套路和剧本、评分联动起来,发现了“剧情套路的密度”和“评分”之间的秘密。更骚的是,他们还把1974个套路分成了15个语义簇,结果发现——钱德勒的莫妮卡式“尴尬”和莫妮卡的“控制欲”,原来都被套路化了?这篇文章让我们看到,AI不仅能看懂图像,也能

FlashRT开源:27倍加速,边缘AI推理告别“重计算”,秒变“快照恢复”
视觉与图像

FlashRT开源:27倍加速,边缘AI推理告别“重计算”,秒变“快照恢复”

当机器人每次重启都要重算大模型,或边缘设备LLM冷启动慢到怀疑人生,这篇论文给出了天才解法:把整个推理的“当时状态”像游戏存档一样快照,下次直接读档。FlashRT通过“执行状态胶囊”,让低延迟、小批量的边缘AI服务延迟狂降27倍,并在LLM、TTS、机器人策略上统一了这套机制。简单说,就是让AI推理变得像按快门一样快。

维也纳工大联手UCLouvain:高熵工程把Fe2VAl热电模块效率拉到新高度,输出功率2.8W!
前沿研究

维也纳工大联手UCLouvain:高熵工程把Fe2VAl热电模块效率拉到新高度,输出功率2.8W!

工业生产余热若不能有效利用,便是巨大浪费。本文没有追求实验室里“毒性强、成本高”的顶尖热电材料记录,而是通过高熵工程把早已证明有“可加工性好、成本低”等潜力的Fe 2 VAl基全Heusler材料性能再次提升,并一步到位制成了能在375K温差下输出2.8W功率的高效模块。这是将实验室成果转化为可实际应用的热电发电机的绝佳范例,值得借鉴!

西北大学&亚马逊AGI最新研究:让大模型学好“纠错”,推理能力暴涨,4B模型打趴8B!
大模型与智能体

西北大学&亚马逊AGI最新研究:让大模型学好“纠错”,推理能力暴涨,4B模型打趴8B!

让大模型第一步就做对,这要求有点高。但如果允许它错几次,再一步步修正呢? 西北大学联手亚马逊AGI提出的REVES框架,精准点出了当前“测试时扩展”技术的核心瓶颈——训练与推理的“步数”不匹配。它巧妙地通过把“接近正确”的错解转化为修正样本,用单步强化学习高效地训练模型学会自我纠错,在代码、数学上全面领先,还用4B模型在圆球填充任务上追平了8B系统的SOTA

仅用7%成本就吊打全场?北卡大学提出TIMEPROVE,让长视频问答学会“先找证据再说话”
视觉与图像

仅用7%成本就吊打全场?北卡大学提出TIMEPROVE,让长视频问答学会“先找证据再说话”

长视频问答一直是个“贵”且“难”的活儿——处理一小时视频,光视觉token就超200万。北卡大学夏洛特分校的TIMEPROVE,提供了极其优雅的解决思路:先用轻量级的动作检测模块“侦察”出关键证据片段,再只把这些精挑细选的短片段送给VLM做“终审”。结果准确率涨了7.3%,VLM调用次数锐减75%,推理成本暴跌93%!这简直就是给LVQA这个“烧钱”领域的一

排名也有偏见?巴西学者提出SMAA-Fair,给多准则决策中的排名加上“公平滤镜”
大模型与智能体

排名也有偏见?巴西学者提出SMAA-Fair,给多准则决策中的排名加上“公平滤镜”

当你在多准则决策中用SMAA方法计算排名时,有没有想过这个排名可能对某些群体“偏心”?巴西学者提出的SMAA-Fair正是来解决这个问题的。它不改变你的模型,只调整每个模拟排名对最终结果的“投票权重”——排名越公平,权重越高。简单有效,思路清奇。

告别黑箱审计:CODE-AUGUR如何让LLM的安全判断变得可验证、可复用
大模型与智能体

告别黑箱审计:CODE-AUGUR如何让LLM的安全判断变得可验证、可复用

继2026年6月聊过AI智能体安全评估之后,这次新加坡国立大学团队带来更猛的干货:不是让LLM当黑盒猎头,而是让它把“觉得安全”的判断写成可执行的断言,再用模糊测试来挑战这些断言。结果?在DARPA的AIxCC基准上比顶尖智能体多发现34%-63%的漏洞,还挖出了22个真实世界的0-day!这才是AI安全审计该有的样子。

流感预测大PK:17个模型“华山论剑”,混合专家模型夺冠!
大模型与智能体

流感预测大PK:17个模型“华山论剑”,混合专家模型夺冠!

流感预报影响万千人健康,从ARIMA到PatchTST再到各种大模型,谁才是预测流感传播的“预言帝”?弗吉尼亚大学这篇论文,用17个模型在真实场景下进行了1-4周预测大PK。结果很有意思:混合专家模型稳居C位,而用大语言模型做时间序列预测,这次表现真是不太能打... 一起来看看到底谁是C位,谁又该回炉重造吧。

告别Sora幻觉,数据视频进入可编辑时代
视觉与图像

告别Sora幻觉,数据视频进入可编辑时代

做汇报还在手动敲PPT、剪GIF动图?港科广的DataMagic直接端到端解决:上传表格+一句话,自动生成带配音、动画、配乐的数据故事视频。新引入的DVSpec规范确保图表和数据的绑定关系一清二楚,再也不用担心AI“算错”数字。更香的是,这还是个“能编辑的视频”,直接划界面改图表、抠文本,甚至指点AI加新镜头,整个数据呈现流程变得前所未有的丝滑。

EA联合大作:强化学习如何让游戏NPC告别“脚本味”?
大模型与智能体

EA联合大作:强化学习如何让游戏NPC告别“脚本味”?

玩过3A大作的朋友都知道,一个“蠢”NPC有多毁沉浸感。EA这次没有跟你聊概念,而是直接把强化学习塞进了EA SPORTS FC 25和Battlefield 6的AI系统里,并总结了一套极具价值的实战方法论,告诉你如何让NPC从“脚本”进化到“有灵魂”。这是游戏AI从学术走向工业的关键一步。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球