LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12809 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:目标跟踪

共 19 篇
西安交大新作TempoGround:流式目标不再“跟丢”,3D指标均提升7.5
视觉与图像

西安交大新作TempoGround:流式目标不再“跟丢”,3D指标均提升7.5

视频流一帧一帧地来,模型能不能不串号、不手抖、不跟丢?西安交大联合EngineAI提出TempoGround,让视觉语言模型在流式输入下连续输出稳定的2D/3D框,3D精度平均提升7.5。这套“状态感知课程预测+强化学习”的组合拳,值得做具身智能和多模态感知的同学认真看一眼。

萨马拉大学实测GPS接收机:三个关键参数调好,跟踪精度提升近50%
视觉与图像

萨马拉大学实测GPS接收机:三个关键参数调好,跟踪精度提升近50%

GNSS接收机的跟踪环路,一直是导航接收机设计中“牵一发动全身”的地方。这篇来自萨马拉大学的论文,没有堆砌高深理论,而是老老实实把积分间隔、相关器间距和滤波器参数这三个工程变量的实测结果摆出来,还附带了FPGA实现的经验教训。想搞懂GPS接收机怎么调优的同学,这篇值得花十分钟细读。

AI · PAPER
视觉与图像

安徽大学SCDT:统一去噪框架,专治RGB-T跟踪模态缺失

医生看病是逐步问诊、看检查单、更新诊断假设的过程,但现有的AI评估全是单轮问答,完全不接地气。这篇论文搞了一个1089例真实病例的多轮诊断基准,把15个模型按真实临床流程从头考到尾。结果发现推理模式反而帮倒忙,医疗微调在小模型上有用、大模型反而没优势。想了解AI在临床诊断中到底几斤几两?这篇必须读。

AI · PAPER
视觉与图像

零参数推理!QueenVIS用两个辅助头搞定视频实例分割

视频实例分割通常需要昂贵的视频标注和复杂的时序建模,但QueenVIS仅用单帧图像训练就拿到了接近SOTA的结果。它通过两个轻量辅助头把外观和空间先验注入Transformer查询,推理时零参数开销,在长视频上提升10.3 AP,简直是为标注稀缺场景量身打造。方法干净、实用,值得工程团队关注。

图像训练逆袭!QueenVIS视频分割零参数涨10.3 AP
视觉与图像

图像训练逆袭!QueenVIS视频分割零参数涨10.3 AP

视频实例分割的“天价标注”让人头疼,QueenVIS却告诉你:只用单帧图像训练,效果堪比视频监督!它通过两个超级简单的辅助头(特征预测+中心预测)把外观和空间先验注入查询向量,推理时零开销、零参数增加。在YouTube-VIS长视频上直接飙了10.3 AP,比很多视频监督模型还稳。代码已开源,值得一试!

VLA-ReID让蜜蜂不再脸盲:HOTA提升1.1
视觉与图像

VLA-ReID让蜜蜂不再脸盲:HOTA提升1.1

多目标跟踪最怕的不是“看不见”,而是“看见了也分不清”。这篇论文直接把 re-ID 的训练方式改成和推理同一套“整帧竞争”逻辑,再用共性外观抑制去压蜜蜂这种高相似目标的混淆,思路很对症。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球