LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12787 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:大语言模型

共 319 篇
盲人用电脑有多难?Stony Brook最新研究:AI助手成功率仅52.5%,理想与现实差距有多大?
视觉与图像

盲人用电脑有多难?Stony Brook最新研究:AI助手成功率仅52.5%,理想与现实差距有多大?

当全世界都在卷Agent能力时,这篇由Stony Brook University和Old Dominion University合作的论文,罕见地将目光投向了最容易被忽视的用户群体——盲人。它用一份扎实的、基于真实世界1258条指令的实证数据,狠狠给“无所不能”的计算机使用代理(CUA)泼了盆冷水:最强模型成功率也仅52.5%。

EMNLP 2026最新:对话推荐总翻车?DREAMS用双蒙特卡洛树让大模型记住偏好,成功率最高+56%
大模型与智能体

EMNLP 2026最新:对话推荐总翻车?DREAMS用双蒙特卡洛树让大模型记住偏好,成功率最高+56%

当大模型碰上对话推荐,最怕的不是模型笨,而是它“聊完就忘”。这篇EMNLP 2026主会论文直接抛弃了把上下文堆进Prompt的粗暴玩法,提出双节点蒙特卡洛树搜索框架DREAMS,一边主动问偏好,一边把对话状态变成精准检索查询,成功率平均提升7.43%,Redial上R@1高达0.507,还开源了代码,值得一读!

康奈尔提出VOLM:与其问“是不是AI写的”,不如问“你贡献了啥”
大模型与智能体

康奈尔提出VOLM:与其问“是不是AI写的”,不如问“你贡献了啥”

当AI检测器还在纠结"这段文字是不是AI写的"时,康奈尔大学的学者们已经换了个更狠的问法:"就算全是AI写的,这里面有多少想法是你先想出来的?"这就像是问一个球员,不是他投进了多少球,而是他比随便从替补席拉上来的人多得了多少分。这篇论文提出的VOLM框架,正试图用棒球统计的智慧,重建人机协作时代的贡献评价体系。

新范式!大模型自主设计质量多样性算法,机器人零干预学技能
视觉与图像

新范式!大模型自主设计质量多样性算法,机器人零干预学技能

想让机器人掌握一项新技能,传统做法是让专家手动设计各种评估函数和多样性指标,费时费力还经常翻车。这篇论文的思路很野:直接把自然语言任务描述丢给大模型,让大模型自己设计整套质量多样性算法的参数。结果如何?4个操作任务上生成的可用技能数量是专家方案的近70倍。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球