LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12851 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:模型架构

共 307 篇
多伦多大学最新研究:黑暗中的3D重建,信噪比低于-4dB也不怕!
视觉与图像

多伦多大学最新研究:黑暗中的3D重建,信噪比低于-4dB也不怕!

黑暗环境下的3D重建一直是计算机视觉的"禁区"——常规的SfM管线在低信噪比下直接崩溃。多伦多大学带来的Dark3R另辟蹊径,通过教师-学生蒸馏把MASt3R这类3D基础模型"教会"在黑暗中看清世界,仅需噪声-干净RAW图像对训练,无需任何3D真值监督。看过的龙迷都直呼"真不错"!

语音增强新范式:FiLM注入SSL特征,实时也能做到
视觉与图像

语音增强新范式:FiLM注入SSL特征,实时也能做到

还在为扩散模型生成的语音不够自然、遇到噪声就“懵圈”而头疼吗?马里兰大学团队这次直接把自监督学习的“语言学耳朵”——Wav2Vec2,装进了扩散模型的U-Net里。效果拔群,PESQ直接飙升0.4,让AI在降噪时更懂你说的是什么,而不是无脑涂抹。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球