LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12820 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:AI应用

共 437 篇
哈佛最新开源:147万份百年报纸,榨出163亿token公共数据集
视觉与图像

哈佛最新开源:147万份百年报纸,榨出163亿token公共数据集

这可能是今年最"考古"的AI基础设施工作:哈佛联手波士顿公共图书馆,把1795到1930年的147万份报纸扫描件,变成163亿token的干净文本。更难得的是,整套流水线设计成工作站级硬件就能跑,租服务器全程只要约2.5万美元——相比云端OCR动辄几十万美元的报价,这性价比简直离谱。对做数据工程、LLM预训练和数字人文的人来说,这篇值得细读。

LVLM遇模态缺失就“趴窝”?TTSD-FAR用0.629%参数把F1从0.48救回0.51
视觉与图像

LVLM遇模态缺失就“趴窝”?TTSD-FAR用0.629%参数把F1从0.48救回0.51

传感器掉线、字幕丢失、画面损坏……LVLM一遇模态缺失就肉眼可见地“降智”。这篇TTSD-FAR偏偏只更新0.629%的参数,就把50%文本缺失下的F1从趴窝的0.4785拉回0.5124,还顺手解决了持续适应的漂移问题。方法不算复杂,思路非常实用,值得所有做多模态落地的朋友读一读。

肿瘤科福音:格拉斯哥大学AI自动分析CT肌肉脂肪,5秒出结果
大模型与智能体

肿瘤科福音:格拉斯哥大学AI自动分析CT肌肉脂肪,5秒出结果

AI医疗卷得飞起,但不少方案动辄几十G显存起步,医院看了直摇头。这篇格拉斯哥大学的工作反其道而行:用GTX 1070就能跑的四款经典CNN,把结直肠癌患者CT里的肌肉与脂肪指标自动算出来,误差低至4.96%,还顺手做了个网页工具。低成本落地范本,值得一读。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球