英伟达GB300
搜索文档
OpenAI自研Jalape?o芯片测试性能领先英伟达GB300,AI推理芯片自主化进程提速
每日经济新闻· 2026-08-26 14:19
市场表现 - 8月25日沪深两市成交额1.83万亿,市场午后震荡回升 [1] - 科创芯片ETF(588290)跟踪指数下跌0.38% [1] - 机器人ETF(159039)跟踪指数上涨2.47% [1] - 创业板人工智能ETF(159279)跟踪指数下跌0.35% [1] - 科创创业人工智能ETF(588470)跟踪指数上涨0.46% [1] - 港股通恒生科技ETF(520840)上涨0.53% [1] - 港股通信息技术ETF(513240)上涨1.92% [1] 个股动态 - 寒武纪上涨4.28% [1] - 海光信息上涨0.54% [1] - 中芯国际下跌0.48% [1] - 蓝思科技下跌0.13% [1] - 联想集团上涨3.91% [1] 行业与公司事件 - OpenAI全新Jalapeno芯片在测试中表现优于英伟达现有产品线,凸显其在自主研发AI处理器方面取得进展 [1] - Jalapeno处理器在单位功耗可处理的AI工作负载以及响应速度两个指标上领先 [1] - OpenAI芯片负责人Richard Ho表示该芯片与英伟达GB300进行了对比 [1] 行业趋势与观点 - 东海证券认为AI驱动下电子行业需求旺盛且供给产能布局缓慢,高景气度有望持续 [2] - 存储价格过高对手机消费电子需求形成压制 [2] - AI基建高景气或将持续,半导体国产化进程加速 [2] - 估值增长过快需警惕短期调整风险,建议逢低关注AI与国产化的结构性机会 [2]
OpenAI首颗芯片,吊打英伟达
格隆汇· 2026-08-26 14:11
核心观点 OpenAI自主研发的Jalapeno推理芯片在性能测试中全面超越英伟达现有产品线,通过单位功耗处理能力和响应速度的双重优势,有望大幅降低AI基础设施成本,并计划于2025年底前部署 芯片性能与测试结果 - Jalapeno在峰值吞吐量下每瓦AI工作量是对比系统的1.5到1.9倍,端到端延迟降低1.7到3.6倍,高交互性工作负载性能提升2.1到4.1倍[7] - 在GPT-OSS 120B、DeepSeek R1和Kimi K2.5 1T三个公开模型上均表现出色,在最大模型Kimi上每瓦峰值性能高出约1.5倍,端到端延迟降低约3.4倍[9] - 芯片额定功率700瓦,测试中持续功耗保持在550瓦或以下[8] - 内部测试中,Jalapeno在OpenAI前沿模型上的优势进一步扩大,表明架构价值随工作负载规模增长而提升[9] - 芯片在高吞吐量和低延迟领域均表现优异,兼具两者优势[2] 芯片设计与技术特点 - Jalapeno专为AI推理阶段设计,非用于模型训练[2] - 设计围绕减少数据移动和通信延迟,模型状态可显式放置并保存在本地[10][11] - 采用单一架构实现高吞吐量和低延迟,现有硬件通常需在两者间权衡[5] - 网络是架构不可或缺部分,允许整个工作负载保持在一个连接系统内[11] - 人工智能在芯片开发中发挥直接作用,帮助团队在九个月内完成从初始设计到流片[11] - 人工智能生成的实现比人工专家编写的实现快1.5到1.8倍(针对选定模块)[12] 合作伙伴与供应链 - OpenAI与博通公司合作开发Jalapeno处理器[2] - 两家公司去年宣布合作协议,今年6月称该处理器以创纪录速度完成开发[2] - OpenAI仍视英伟达为重要芯片供应商和合作伙伴[5] - 公司将继续广泛部署英伟达及其他合作伙伴的加速器用于训练和推理[15] 成本与部署计划 - 新芯片广泛应用后OpenAI成本将大幅降低[1] - 公司计划年底前开始在计算基础设施中部署Jalapeno[15] - 只要提高产量且成本节约达预期,公司将使用自研芯片处理更多AI任务[1] - 客户可根据需求选择更经济实惠或性能更优的方案[2] - 低电压(700瓦)下强劲性能可帮助数据中心节省电力成本[2] 行业竞争格局 - 英伟达GB300是测试基准系统中的领先者[1] - Etched公司上周宣布融资后估值达210亿美元,已开始出货低电压芯片[4] - MatX公司由两位谷歌芯片前员工创立,研发同时实现高吞吐量和低延迟的半导体[4] - OpenAI短期内不会取代Cerebras等供应商,公司对计算能力需求极大[3] 多代路线图 - Jalapeno是多代路线图的第一代,第二代正在开发中,第三代正在成型[15] - 第二版芯片开发工作已接近尾声,预计未来几个月内完成流片[4] - 公司已在着手设计第三代AI技术以降低全球基础设施成本[4] - 每一代都将在积累经验基础上进一步提升效率和速度[15]
OpenAI自研芯片Jalapeño跑赢英伟达GB300,最大卖点是高吞吐、低延迟
金十数据· 2026-08-26 11:17
核心观点 - OpenAI自研推理芯片Jalapeño在特定基准测试中性能功耗比和响应速度超越英伟达GB300,但该芯片仅用于推理,不涉及训练,且未与英伟达最新一代Vera Rubin对比,因此不构成对英伟达的全面替代[1][2][4] 芯片性能与测试结果 - Jalapeño在SemiAnalysis的InferenceX基准测试中,对比英伟达GB300,在每名用户Token生成速度和每千瓦吞吐量两项指标上取得领先[2] - 在DeepSeek R1模型上,并发量为1时,Jalapeño每名用户生成速度超过700 Token/秒[2] - Jalapeño在几乎所有测试场景中的性能功耗比都超过GB300,且未使用多Token预测(MTP),而对比芯片使用了各自表现最好的配置并启用MTP[2] - 测试覆盖了OpenAI自身较小的开放模型、DeepSeek和Moonshot AI的第三方模型,其中在Kimi模型上的优势更明显[2] - 内部测试中,Jalapeño运行了尚未发布的大型先进模型,公司认为随着工作负载变大变复杂,该设计的价值可能进一步提升[3] 功耗与成本优势 - Jalapeño在约700瓦功耗下取得较强性能,电力是大型AI数据中心的重要成本来源[3] - OpenAI硬件负责人Richard Ho表示,随着Jalapeño扩大部署,应会大幅降低成本,公司希望通过更低的单位推理成本支撑不断增加的模型调用和用户需求[3] - 芯片专门优化了Prefill和通信阶段,以减少数据移动和通信延迟,模型状态(包括KV Cache)被明确放置并尽量保留在本地[3] 芯片定位与设计特点 - Jalapeño由OpenAI与博通合作开发,从2024年年中开始组建团队和推进设计,到完成流片约用了16个月[1] - SemiAnalysis认为Jalapeño是一款通用推理处理器,可运行不同模型和工作负载,优势来自软硬件协同,而非对单一推理环节的极端优化[4] - 芯片目前只面向推理(Inference),不负责大模型训练,训练仍是英伟达GPU的重要优势领域[1][4] - OpenAI并未将Jalapeño包装成“英伟达杀手”,公司硬件负责人明确表示英伟达是很好的合作伙伴,仍需要大量英伟达芯片[1] 部署计划与供应商策略 - Richard Ho预计Jalapeño将在2026年底以“非常小的规模”开始部署,更大规模使用要到2027年,届时英伟达产品可能已进一步迭代[4] - OpenAI不会停止使用其他推理芯片供应商,部分模型仍使用Cerebras Systems的技术[5] - Richard Ho表示Jalapeño能处理更大模型,但短期内不会取代Cerebras,因为公司对算力需求巨大,已签下多个不同供应商[5] 芯片迭代与长期规划 - Jalapeño不是一次性项目,OpenAI计划将其发展为多代际平台,让模型、芯片、内存和AI产品共同演进[5] - 公司使用自身AI模型参与芯片开发,以加快设计流程[5] - 第二代芯片已进入较深入开发阶段,预计将在“未来几个月”完成流片,第三代产品的概念设计也已启动[5]
背刺英伟达?OpenAI甩出新“武器”!
格隆汇APP· 2026-08-26 10:47
核心观点 - OpenAI自研推理芯片Jalapeño在吞吐、能效、延迟三项指标上全面反超英伟达GB200与GB300,并被认为超越了英伟达Rubin芯片 [1][3] - 该芯片由OpenAI与博通合作开发,设计到流片仅用9个月,AI辅助设计是关键 [5] - SemiAnalysis判断CUDA的护城河可能已死,但OpenAI与英伟达的绑定仍在加深 [7] 芯片性能对比 - 单用户出词速度:Jalapeño每秒1459个Token,GB200为535个 [1] - 任务完成时间:Jalapeño用1.65秒,GB300花了5.99秒 [1] - 功耗:Jalapeño标称700瓦,实测持续功耗压在550瓦以内;GB200/GB300标称1400瓦 [1] - 每瓦AI工作负载提升1.5至1.9倍,端到端延迟降低1.7至3.6倍,高度交互式负载下优势扩大到2.1至4.1倍 [3] 芯片设计与制造 - 设计到流片仅用9个月,业内常见周期为18到36个月 [5] - 将自家最强模型GPT-Astra和Codex用于AI辅助设计,使SIMD单元面积减少8%、矩阵引擎面积减少10% [5] - 在注意力与MoE模块上,AI生成的代码比人类顶尖专家快1.5到1.8倍 [5] - 主计算die约840平方毫米,距EUV掩模版极限858平方毫米只差18平方毫米 [5] 硬件规格与成本 - 配6颗HBM4、共216GiB、15.4TB/s [5] - 每瓦HBM带宽22,第二名Rubin是11.1,GB300只有5.71 [5] - 每芯片每小时总拥有成本1.56美元,与H100的1.55美元几乎持平,Vera Rubin是3.61美元 [5] - 与博通合作,两家于去年10月签下10GW定制加速器大单 [5] 量产与未来规划 - 量产2027年逐步爬坡,下一里程碑是100兆瓦 [5] - Gen2已在深度开发、Gen3正在成形 [5] - 2026年底先部署进OpenAI自己的数据中心 [5] 行业竞争格局 - 英伟达Rubin比Jalapeño早一个月完成CoWoS流片,但外界能看到的成绩只有CoreWeave工程样片数据 [7] - 英伟达没有像OpenAI这样把第三方放进实验室随便测 [7] - SemiAnalysis判断CUDA的护城河可能已经死了 [7] 英伟达与OpenAI的绑定关系 - 8月17日,英伟达同意为OpenAI俄亥俄州数据中心园区提供最高1050亿美元融资 [7] - OpenAI承诺2026年下半年部署首批1吉瓦英伟达Vera Rubin系统 [7] - OpenAI芯片负责人Richard Ho表示仍需要大量英伟达芯片 [7] - 这一切落在英伟达财报前夜,焦点包括OpenAI算力承诺的会计处理 [7]
你敢信,OpenAI第一次做芯片,竟然把英伟达全系干趴下了?!
是说芯语· 2026-08-26 09:00
核心观点 - OpenAI首颗自研芯片Jalapeño在AI推理性能上全面反超英伟达GB200和GB300,标志着AI芯片竞争格局的重大变化 [1] - OpenAI通过AI辅助芯片设计,将模型、芯片和软件拧成加速飞轮,对英伟达的CUDA护城河构成实质性威胁 [54][55][60] Jalapeño芯片性能实测 - Jalapeño每秒可生成1459个Token,英伟达GB200仅535个,不到一半 [3] - Jalapeño完成一个任务仅需1.65秒,GB300需约6秒,差距达3.6倍 [4] - 将GB300推至最快解码速度时,Jalapeño吞吐量是GB300的104.3倍 [4][23] - 在GPT-OSS 120B、670B和1T模型上,Jalapeño分别快2.7倍、4.1倍和3.8倍 [25] - 两个Token之间间隔仅0.69毫秒 [18] - 标称功耗仅700W,GB300为1400W,整整一半 [5] - 每瓦特AI工作负载提升1.5–1.9倍,端到端延迟降低1.7–3.6倍,高度交互式工作负载性能提升2.1–4.1倍 [15] - 按各自最好工作点算峰值,差距温和至1.9倍、1.7倍和1.5倍 [31] - 真正拉开距离的是高交互场景,随着出词速度提升,领先幅度从1.7倍涨至104.3倍 [30][32] 系统级能效与成本 - 将供电、散热、网络全算入后,Jalapeño每颗1.125千瓦,GB200为1.87千瓦,Vera Rubin为3.3千瓦 [34] - 跑GPT-OSS时,Jalapeño每兆瓦每秒吐出约5300万个Token,GB200 NVL72仅约1000万 [34] - 每芯片每小时总拥有成本,Jalapeño为1.56美元,与H100的1.55美元几乎一样,Vera Rubin为3.61美元 [35] - 每瓦HBM带宽Jalapeño为22,第二名Rubin为11.1,GB300仅5.71,高出整整一倍 [52] - 每瓦FLOPs Jalapeño为19.1,Rubin为19.4几乎打平,但Rubin需烧1800瓦以上,Jalapeño仅700瓦 [52] 未开启的优化潜力 - 上述成绩未开启投机解码和Token预测,也未做prefill和decode分离部署,而对比芯片均跑在各自最优配置 [37] - SemiAnalysis估算,仅投机解码一项就能将每Token成本再压掉2/3以上 [38] AI辅助芯片设计 - 从设计到流片仅用九个月,业内常见周期为18-36个月 [43] - 协助开发的模型为GPT-Astra(外界传的GPT-6),成为团队最强辅助 [44][46] - AI辅助设计使SIMD单元面积减少8%,矩阵引擎面积减少10%,且时序和功耗更优 [47] - 主计算die约840平方毫米,EUV光刻机掩模版极限为858平方毫米,离物理天花板仅差18平方毫米 [50][51] - B0步进已在晶圆厂,每瓦性能比A0再高约25% [53] - 在注意力机制和MoE模块上,AI手敲代码比人类顶尖专家快1.5到1.8倍 [53] 对英伟达CUDA护城河的冲击 - SemiAnalysis判断CUDA护城河可能已死,理由是速度 [60][61] - 英伟达Rubin比Jalapeño早一个月完成CoWoS流片,但外界仅能看到CoreWeave工程样片数据,英伟达未像OpenAI那样让第三方随意测试 [62] - 问题出在软件起步速度,英伟达硬件本身没毛病 [63] - OpenAI从零开始无历史包袱,架构可完全按白纸来画 [64] - 英伟达自己的GPU正在实时催生自己的接班人 [65] 未来路线图与战略布局 - Jalapeño仅为第一代,Gen2已在深度开发,Gen3正在成形 [73] - 量产要到2027年逐步爬坡,下一个里程碑是100兆瓦 [74] - 去年10月OpenAI与博通签署10GW定制加速器合作大单 [68] - 10GW量级相当于约十座核电机组满发 [70] - 数据中心大总管Chris Malone(负责星际之门项目)离职,但核心高管离场挡不住路线继续向前 [76][79]
英伟达,七连跌“刹车”
上海证券报· 2026-08-26 08:42
美股市场与科技板块表现 - 美股三大指数集体收涨,道指涨0.3%报53577.4点,标普500指数涨0.32%报7677.28点,纳指涨0.66%报26151.3点 [1][5] - 英伟达上涨2.19%,结束自2022年以来最长连跌(七连跌) [1][5] - 科技股从前一交易日抛售中反弹,投资者在英伟达公布财报前保持谨慎观望 [3] - “科技七巨头”其他个股涨跌不一,Meta涨1.97%,微软涨0.9%,特斯拉涨0.37%,苹果跌0.14%,谷歌跌0.36%,亚马逊跌0.39% [7] - 光通信、存储板块多数上涨,Lumentum涨超6%,Applied Optoelectronics涨超5%,Coherent涨超4% [3][7] - 希捷科技、西部数据涨超3%,SK海力士、美光科技涨超2% [3][7] - 加密货币概念股走强,Hut 8 mining涨超7%,Figure、IREN涨超6%,Circle、Coinbase涨超4%,Strategy涨超3% [7] - 石油股走弱,埃克森美孚跌超2%,雪佛龙、康菲石油、斯伦贝谢跌超1% [7] - 矿业股走强,埃氏金业、科尔黛伦矿业、金田涨超3% [7] - 中概股多数上涨,纳斯达克中国金龙指数涨1.11%,富途控股涨超8%,世纪互联涨逾6%,BOSS直聘涨超5%,奇富科技涨逾4%,网易涨超4%,万国数据涨近4% [7] - 中概股跌幅方面,亿航智能跌超7%,晶科能源跌逾4%,理想汽车跌超1% [7] - 市场人士认为,尽管美加贸易摩擦升级,市场仍因中东局势缓和、AI算力需求旺盛、企业盈利稳健而维持乐观情绪 [7] 大宗商品市场 - 对中东地缘冲突担忧缓解,国际油价大跌,布伦特原油期货主力合约25日跌超5%,跌破86美元/桶 [3] - WTI原油期货主力合约跌4.59%,报81.11美元/桶 [3] - 国际金价小幅上涨,截至25日收盘,现货黄金价格涨0.12%,报4657.115美元/盎司 [3] - 现货白银价格跌0.47%,报68.61美元/盎司 [3] 关键宏观事件 - 市场注意力高度集中于本周两大关键事件:英伟达周三盘后财报,以及美联储主席沃什周五在杰克逊霍尔全球央行年会上的讲话 [3] - 杰克逊霍尔全球央行年会将于8月27日至29日举行,沃什将于当地时间8月28日上午10时发表讲话 [8] - 美国银行8月24日报告称,若沃什明确表示在通胀持续高企情况下准备重启加息,有望稳定长端美债并推动收益率曲线趋平 [8] - 巴克莱预计,沃什释放“必要时重启加息”信号的概率超过50% [8] - 市场尤其关注沃什对通胀及9月政策路径的表态 [8] 地缘政治与能源安全 - 伊朗外交部副部长加里巴巴迪表示,伊朗与阿曼就霍尔木兹海峡航线新达成谅解,进入波斯湾的航线将途经伊朗水域,离开波斯湾的航线将途经阿曼和伊朗水域,任何军舰不得通过该海峡,只允许商船通行 [10] - 上述通行安排为临时措施,两国后续将在30至60天内就划设一条新的永久航线展开谈判 [10] - 加里巴巴迪强调,如果伊朗的要求和条件得不到满足,霍尔木兹海峡将继续关闭,重开前提包括彻底结束所有战事、解除封锁、妥善解决也门问题,美国必须全面履行此前未能履行的所有承诺 [10] - 美国总统特朗普25日称,霍尔木兹海峡“国际水域”内的所有水雷均已被清除或引爆,美方对伊朗布设水雷行为实行“零容忍”政策 [10] - 一名接近伊朗谈判团队的消息人士表示,伊方希望通过巴基斯坦向美方明确转达有关霍尔木兹海峡的立场和谈判条件 [12] 贸易摩擦 - 加拿大政府宣布对价值约200亿美元的美国商品征收报复性关税 [14] - 自9月8日起,加拿大将对约700种美国产品征收反制关税,税率分别为15%、25%或50% [14] - 加拿大政府将推出75亿加元的援助计划,支持受美国新关税影响的企业和工人 [14] - 美国和加拿大的贸易谈判在最后一刻宣告破裂,美国对价值200亿美元的加拿大商品征收50%的关税 [14] 科技与航天投资 - SpaceX计划投资1000亿美元在路易斯安那州南部建设一座巨型新发射场,占地面积约12.5万英亩 [16] - 名为“路易斯安那星港”的发射场预计将包括5个发射综合体,每个综合体配备两个发射台,还将配备推进剂生产、电力供应、深水航运能力、飞行器处理设施以及一座机场 [16] - 该项目将从2027年开始建设,目标是2029年完成首次发射 [17] - 马斯克表示,路易斯安那星港最终将拥有“超过一打的发射台”,支持每天进行30次“星舰”发射,成为地球上最大的发射场 [17] - 该计划对于SpaceX建造最多100万颗数据中心卫星的计划至关重要 [17] - 短期来看,这座发射场将为SpaceX提供第三个发射“星舰”的场所,目前主要在得克萨斯州南部建造和发射,并在佛罗里达州卡纳维拉尔角开发第二个发射地点 [17] - 今年至今,SpaceX仅进行了两次“星舰”试飞,技术团队正在攻关飞船回收难题,马斯克预计今年底或明年初完成飞船的复用发射 [17] AI芯片竞争 - OpenAI表示其全新Jalapeno芯片在测试中的表现优于英伟达的现有产品线,凸显在自主研发AI处理器方面取得进展 [19] - 在测试中,Jalapeno处理器在两个指标上领先:单位功耗可处理的AI工作负载以及响应速度 [19] - OpenAI芯片负责人表示,该芯片与英伟达GB300进行了对比,后者是此次测试所使用公开基准测试平台上的领先产品 [19]