LONGGE AI RESEARCH DAILY

龙哥读论文

每天筛选值得关注的 AI 论文,用工程视角拆解方法、实验和真正的落地价值。

目前已发表 1573 篇文章

PaperDaily 数据库收录 论文拆解 12787 研究思路 385 AI 资讯 208 开源项目 164 科研招聘 128 学习资料 8 热点主题 493 论文成功模式 1625

标签:AI芯片

共 18 篇
诺思罗普·格鲁曼新方案:10纳秒无微波读取超导量子比特,保真度99.7%
前沿研究

诺思罗普·格鲁曼新方案:10纳秒无微波读取超导量子比特,保真度99.7%

超导量子比特的读取一直是规模化的“卡脖子”环节——传统色散读取又慢又依赖微波。诺思罗普·格鲁曼团队这次直接甩出一套无微波方案:10纳秒制备与读取、99.7%保真度、282个器件验证,还顺带把量子信号转成数字逻辑,整套思路对超导量子计算控制系统而言,属于值得细读的硬核参考。

130nm流片实测:电压跌落1.2周期降频,告别亚稳态焦虑!
大模型与智能体

130nm流片实测:电压跌落1.2周期降频,告别亚稳态焦虑!

电源电压像坐过山车,芯片时钟就得跟着遭殃?这篇来自CISPA和IHP的流片实测论文,把一个曾只存在于仿真里的全数字自适应时钟频率校正电路,放到了130nm真实硅片上验证。没有PLL、全数字、1.2个时钟周期内响应,还顺手把亚稳态这个老大难问题用掩蔽锁存器给“治”了。做低功耗芯片、高性能处理器或对电压波动敏感的数字电路设计的朋友,这篇值得认真看一看。

模拟存内计算秒变“猪队友”?北大港大出手:只调一个引导参数,扩散模型FID狂降75%!
视觉与图像

模拟存内计算秒变“猪队友”?北大港大出手:只调一个引导参数,扩散模型FID狂降75%!

模拟存内计算(CIM)部署扩散模型是低功耗生成的重要路径,但芯片非理想性会让引导信号悄悄“失真”。这篇北大港大合作的工作把失效通道定位到无分类器引导残差上,并给出免重训练、只改一个标量参数的优雅修复方案,在3个扩散模型上大幅恢复生成质量,值得所有关注AI芯片落地和扩散模型的读者一读。

Google+UC Berkeley新作:ArchAgent v2自动进化三级预取器
大模型与智能体

Google+UC Berkeley新作:ArchAgent v2自动进化三级预取器

预取器是芯片里的“预言家”,过去全靠人类工程师手搓,如今Google联合UC Berkeley让LLM进化智能体自己“进化”出一个三级预取器,直接拿下DPC4冠军,IPC比人类顶级方案还高0.3%,低带宽场景下更是领先2%。这是AI自动硬件设计第一次真正在权威竞赛里赢过人类冠军,值得所有做体系结构和AI的人围观。

AI · PAPER
大模型与智能体

1B vs 70B算什么,LLM推理力度自适应才是真省钱

LLM智能体调芯片,烧的是真实美元。这篇鲁汶大学新作给出两个反常识答案:精心雕琢的长期记忆,不如普通拼接有用;真正决定优化质量与成本比的,是推理力度该何时加码。Ares靠一个耐心计数器动态调度,等成本下PPA优化深度提升23–27%,成本仅SotA的12%——继6月聊过让智能体学会止损之后,省钱这件事从动作层面卷到了芯片设计。

AI · PAPER
大模型与智能体

5.5倍吞吐量提升!SK海力士用PNM破解LLM混合长度服务难题

当LLM服务的上下文长度从几百到百万不等时,GPU内存成了最大的短板。SK海力士与KAIST联手拿出硬核方案——NELSSA,把长上下文请求“请”到CXL互联的PNM(近内存处理)芯片上执行,GPU只管短请求和FFN。实测解码吞吐量飙涨5.5倍,P99延迟骤降15倍,而且是在真实硬件上跑出来的!这可能是下一代LLM基础设施的关键拼图。

清华参与,HCCStar质子束实测:三模冗余到底有多稳?
前沿研究

清华参与,HCCStar质子束实测:三模冗余到底有多稳?

继2026年7月聊过DeepSeek边缘芯片的极致能效后,龙哥今天带来一篇更硬核的芯片测试——为HL-LHC升级量身打造的HCCStar ASIC质子束实测。三模冗余保护效果如何?数据丢失率低至10⁻¹⁰,每年每bit仅约10次修正翻转。这不是理论推断,是实打实的辐射数据。

LONGGE AI COMMUNITY

把每天读到的论文,变成长期积累

加入「龙哥读论文」知识星球,持续获取 AI 论文、资讯、开源项目、招聘与研究思路。

加入龙哥读论文微信群:添加微信 kangjinlonghelper,备注“研究方向 + 地点 + 学校/公司 + 昵称”。

龙哥读论文知识星球二维码 微信扫码加入知识星球