曦望发布新一代推理GPU芯片启望S3,单位Token推理成本降低90%
新浪财经·2026-01-27 19:36
炒股就看金麒麟分析师研报,权威,专业,及时,全面,助您挖掘潜力主题机会! (来源:智通财经) 启望S3为面向大模型推理的定制化GPGPU芯片。智通财经记者了解到,其在典型推理场景下的整体性 价比较上一代提升超10倍。算力与存储设计上,该芯片支持FP16至FP4精度切换,采用LPDDR6显存方 案,显存容量提升4倍。在DeepSeek V3/R1满血版等主流大模型推理中,单位Token成本较上一代降低约 90%。 1月27日,智通财经记者获悉,国产GPU厂商曦望(Sunrise)发布新一代推理GPU芯片启望S3。这是曦 望在近一年累计完成约30亿元战略融资后的首次集中公开亮相。2025年,曦望芯片交付量已突破万片。 ...