Workflow
AI5 芯片
icon
搜索文档
金元证券每日晨报-20260921
金元证券· 2026-09-21 12:09
报告核心观点 - 华为全联接大会2026发布昇腾960系列芯片及超节点,芯片性能翻倍,NPO技术首次规模商用,推动国产AI算力竞争从单芯片向系统级协同演进 [20][22] 研报推荐:华为全联接大会相关分析 昇腾960芯片性能与迭代 - 昇腾960DT算力提升至2 PFLOPS(FP8)/4 PFLOPS(FP4),互联带宽2.2TB/s,访存容量288GB,访存带宽9.6TB/s [20] - 较前代950DT,算力和访存容量翻倍,访存带宽提升至2.4倍 [20] - 昇腾960PR FP4算力提升至8 PFLOPS,访存容量192GB,带宽2.4TB/s [20] - FP4精度算力达到前代950PR的4倍,访存容量和带宽提升50% [20] - 960DT风冷版计划于2027Q1就绪,较原先规划提前三个季度 [20] - 960PR液冷版计划于2027Q3发布,较原先规划提前一个季度 [20] - 后续昇腾970、昇腾980等产品将保持年度迭代节奏 [20] 超节点芯片全栈自研与系统级协同 - 华为围绕灵衢(UnifiedBus)构建11颗超节点关键芯片,覆盖“算”(鲲鹏CPU、昇腾两款NPU)、“存”(智能存储、磁盘控制、存储控制芯片)、“管”(灵衢管理芯片、设备管理控制芯片)、“联”(灵衢互联芯片、NPO高密光引擎、网卡芯片)四大类 [22] - 灵衢以统一协议打通CPU、NPU、存储等组件互联,并延伸至超节点间集群级互联 [22] - 与英伟达NVLink在GPU互联领域的定位相比,灵衢更强调面向超节点内部及集群级互联的统一架构能力 [22] NPO首次规模化商用 - 华为发布业内首个量产NPO产品Hi-ONE,单体传输容量7.2T,首次采用内置光源设计 [22] - 昇腾960超节点以约5500个Hi-ONE替代约4.8万颗800G光模块 [22] - 功耗降低超550千瓦,无故障运行时间提升一倍,可用度达99.8% [22] 4096卡超节点落地与AI基础设施演进 - 昇腾910C超节点已部署超1000套,950超节点已规模化商用 [22] - 新发布的960超节点支持4096卡,面向十万亿参数模型训练推理,RTT时延2μs [22] - 960系列通过芯片性能提升、灵衢统一互联架构及NPO等技术协同,推动国产AI算力竞争从单芯片性能比拼向超节点规模、互联效率及系统级协同能力演进 [22] - 随着超节点向更大规模集群升级,算力基础设施价值量有望向高速互联、光电融合、服务器及电源等系统级环节延伸,相关产业链厂商有望受益 [22]