OpenAI's Jalapeño chip is built for fast inference at scale, benchmarks show
塔吉特塔吉特(US:TGT) TechCrunch·2026-08-25 22:22

核心观点 - OpenAI在Hot Chips会议上公布了其自研推理芯片Jalapeño的详细信息和首批基准测试结果,该芯片在性能和能效上显著超越当前最先进的英伟达Blackwell系统 [1][2] 产品性能与部署 - 在SemiAnalysis的InferenceX基准测试中,Jalapeño实现了比当前最先进推理处理器更高的每用户token数和每千瓦吞吐量 [1] - OpenAI硬件负责人Richard Ho表示,Jalapeño在每单位功耗下可服务更多AI工作,同时响应速度更快,既能高效服务大量客户,也能实现极低延迟 [2] - 该对比对象为英伟达Blackwell系统,但到Jalapeño全面部署时,竞争对手可能已大幅进步 [2] - Ho估计Jalapeño将在2026年底以“非常小的规模”部署,更显著的部署将在2027年到来 [2] 开发与合作 - Jalapeño于去年10月首次公布,由OpenAI与博通紧密合作开发,OpenAI自身的模型也参与了开发过程 [3] - OpenAI计划将Jalapeño打造为多代际平台,使AI产品、模型、芯片和内存能够协同开发 [3] 技术架构与优化 - 凭借全栈方法,OpenAI能够解决推理过程中常导致瓶颈的特定阶段,特别是预填充和通信阶段 [4] - Jalapeño的设计旨在最小化数据移动和通信延迟,使模型状态(包括生成响应时使用的KV缓存)能够被明确放置并保持本地化,同时系统为每个推理阶段激活正确的计算、内存和网络组合 [5]

Target-OpenAI's Jalapeño chip is built for fast inference at scale, benchmarks show - Reportify