轻量旗舰模型
搜索文档
晚点独家丨智谱推出对标 DeepSeek 的轻量旗舰模型,由 10 万国产卡支持
晚点LatePost· 2026-08-26 23:19
行业竞争格局与市场动态 - 轻量旗舰模型市场迎来新竞争,智谱发布GLM-5.3 Flash,旨在对标DeepSeek V4 Flash [3][4] - 8月DeepSeek V4 Flash提价,证明市场强劲需求,也预示更激烈竞争的到来 [5] - 中国公司自6月以来争相发布能力接近美国次等级闭源模型的产品,包括智谱GLM-5.2、Kimi K3、DeepSeek V4 Pro等 [8] - 在美国,Meta和SpaceXAI等第二梯队公司正瞄准OpenAI和Anthropic的最先进模型,后者价格是中国模型的数十倍 [10] - 中国模型选择多、能力差距小,厂商需与同行、开源部署、云厂商赠送额度竞争,模型难以作为稀缺品定价,更接近标准云服务价格 [10] 智谱GLM-5.3 Flash产品特性 - GLM-5.3 Flash拥有300B参数规模,参数量约为GLM-5.3的40%,与DeepSeek V4 Flash几乎持平 [4] - 采用与GLM-5.3不同的架构设计,具有原生多模态能力,支持图像视频输入,是智谱战略聚焦coding以来第一次推出具有多模态能力的新模型 [4] - 调用超过10万张国产品牌芯片集群用于推理服务,算力供应商或来自华为、摩尔线程与海光 [4] - 全栈适配国产算力,线上流量均由国产芯片承接,智谱在技术文档中表示其集群“硬件效率及单位token成本已经达到了与主流英伟达GPU相当的水平” [8] 性能与定价对比 - 根据智谱内部评测,GLM-5.3 Flash的Artificial Analysis Intelligence分数为57分,超过上一代旗舰模型GLM-5.2,和Claude Opus 4.8持平,高于DeepSeek V4 Pro正式版的53分 [7] - GLM-5.3 Flash每百万token输入0.8元,输出2.8元,缓存命中价格0.23元,正好为GLM-5.3的十分之一 [7] - 横向对比调价后的DeepSeek V4 Flash,其谷时价格分别为输入1.5元、输出4.5元、缓存0.05元,综合输入和输出成本,GLM-5.3 Flash在绝大多数常规调用场景下更便宜 [7] - 上线前两周GLM-5.3 Flash实行半价 [7] - 以Claude Opus 4.8为例,官方输出价格为25美元,而GLM-5.3 Flash海外输出价格则为0.5美元 [10] 市场测试与匿名发布策略 - 正式发布前智谱在OpenRouter等第三方平台以0x Alpha名义测试,5天流量累积超过50T,由于完全免费,刷新了OpenRouter与OpenCode流量增长纪录 [7] - 这不是智谱第一次以匿名形式发布新模型,今年春节前夕OpenRouter上出现名为Pony Alpha的模型,后被证明是智谱的GLM-5模型 [8] 行业定价与需求弹性 - 性能提升同时涨价一度占据叙事主流,Kimi K3输出价格高达100元,超过K2.6三倍多,智谱上半年提价后输出价格也达到28元 [8] - 梁文锋录音中曾表示智能需求没有弹性,DeepSeek只需赚取合理利润,但8月DeepSeek全面提价,DeepSeek V4 Pro从6元涨到13.5元,高峰27元;DeepSeek V4 Flash输出从每百万token 2元涨到4.5元,高峰时段9元,官方理由是算力稀缺 [9] - 事实证明智能能力需求同样有弹性,特别是轻量级旗舰模型,用户对价格敏感 [9] - 涨价后,在OpenCode上DeepSeek V4 Flash模型调用量掉了一半,这部分需求成为国产模型厂商新的增长空间 [9] - 不考虑算力采购与研发成本,模型推理是一门毛利很高的好生意,前提是有足够大的需求与足够用的性能 [10]