行业观点更新:晨会纪要-20260910
湘财证券·2026-09-10 07:31

核心观点 - 国产大模型商业化正迎来Token用量、单位智能成本及算力供给可控性的三维共振,国产算力在推理侧大规模承接真实负载,抬升了国内AI硬件与配套软件栈景气持续性与渗透率的置信度,维持计算机行业“买入”评级 [5] 智谱中报:Token经济兑现与商业闭环 - 智谱2026年上半年实现营收约9.54亿元,同比增幅接近400% [2] - 开放平台及API业务收入约8.25亿元,收入占比自2025全年的26%大幅提升至87% [2] - 业务结构切换的核心驱动在于模型在代码生成等效果可量化核验的任务场景交付能力显著优化,客户付费模式从定制化项目部署转向云端调用与订阅制模式 [2] - 截至6月底MaaS平台Token调用量较年初增长超40倍,其中Coding Plan调用量增幅达23倍以上 [2] - 同期API均价上行约101%,开放平台及API业务毛利率提升至24.6%,相对2025全年改善约6个百分点 [2] - 公司定义的“算力乘数”,即每1元算力成本对应的开放平台及API业务收入同比提升约14倍,改善来自单位Token承载的智能提高及单Token推理成本快速下降 [2] - 截至8月末智谱年度经常性收入ARR达到约16亿美元,较7月时披露的10亿美元水平进一步抬升 [2] GLM-5.3-Flash:智能、成本与国产芯片推理闭环 - 8月下旬智谱发布并开源GLM-5.3-Flash(总参数320B,激活参数18B),产品定位与旗舰模型GLM-5.3形成差异化,Flash聚焦高并发、成本敏感型海量调用场景 [3] - 模型采用稀疏注意力与线性注意力混合架构、流形约束超连接(mHC)等技术方案,依托约30万亿Token规模的多模态预训练数据集训练完成 [3][4] - 在Artificial Analysis智能指数评测得分达57分,性能对标Claude Opus 4.8,定价仅为GLM-5.3的1/10、Claude Opus 4.8的1/40 [4] - 智谱首次在超大规模生产场景下,基于自研高带宽互联组网的国产芯片集群对外提供在线推理服务 [4] - 公司已搭建起十万级国产芯片构成的低成本推理资源池,基于SGLang定制专属推理引擎,叠加量化、层拆分、Encode-Prefill-Decode分离调度等优化手段,端到端服务性能相对硬件原始基线实现约3倍提升 [4] - 单Token推理成本已经能够对标主流英伟达GPU的水平 [4] - 需求端Token调用规模持续扩张与供给端国产加速卡、超节点硬件集群及推理软件栈形成真实开发者流量下的闭环验证,“国产芯片承载国产大模型”的产业逻辑从技术适配阶段迈入具备生产级经济可行性的商业化验证阶段 [4] 相关受益环节 - 大模型MaaS、编程智能体与行业Co-work应用:智谱验证了开放平台与Coding Plan可同时实现量价与毛利改善,且商业阶梯向Agent、网络安全等Co-work延伸,继续关注具备模型迭代效率与推理成本优势、能把Token消耗转化为经常性收入的平台型公司以及在软件工程、安全、数据分析等可验证任务中沉淀工作流、数据权限与行业Know-how的应用与解决方案厂商 [6] - AI算力与产业基建:Token调用量的扩张、单位推理成本下降与国产芯片万卡集群上线,意味着景气叙事延伸至推理放量与国产替代,继续看好国产AI加速卡与超节点整机、高带宽存储与内存,液冷与高速互联等领域 [6]

行业观点更新:晨会纪要-20260910 - Reportify