Workflow
GB300
icon
搜索文档
背刺英伟达?OpenAI甩出新“武器”!
格隆汇· 2026-08-26 12:08
OpenAI自研推理芯片Jalapeño性能与战略分析 - OpenAI首颗自研推理芯片Jalapeño在Hot Chips大会上公布实测成绩,在吞吐、能效、延迟三项指标上全面反超英伟达GB200与GB300 [1] - 单用户出词速度Jalapeño每秒1459个Token,GB200为535个 [1] - 跑完同一任务Jalapeño用时1.65秒,GB300用时5.99秒 [1] - 标称功耗Jalapeño为700瓦对GB300的1400瓦,实测持续功耗压在550瓦以内 [1] - 测试覆盖GPT-OSS 120B、DeepSeek R1 670B和Kimi K2.5 1T三款公开模型 [1] - 每瓦AI工作负载提升1.5至1.9倍,端到端延迟降低1.7至3.6倍,高度交互式负载下优势扩大到2.1至4.1倍 [1] - 从设计到流片仅用9个月,业内常见周期为18到36个月 [1] - 著名半导体分析师Dylan Patel称“被掀翻的不只是Blackwell,就连英伟达Rubin芯片也被超越了” [1] 芯片设计、规格与成本 - 设计秘诀是将自家最强模型GPT-Astra(外界传的GPT-6)和Codex用于流片室,AI辅助设计让SIMD单元面积减少8%、矩阵引擎面积减少10% [2] - 在注意力与MoE模块上,AI生成的代码跑得比人类顶尖专家快1.5到1.8倍 [2] - 主计算die约840平方毫米,距EUV掩模版极限858平方毫米只差18平方毫米 [2] - 配6颗HBM4、共216GiB、15.4TB/s,每瓦HBM带宽22,第二名Rubin是11.1,GB300只有5.71 [2] - SemiAnalysis估算每芯片每小时总拥有成本1.56美元,与H100的1.55美元几乎持平,Vera Rubin是3.61美元 [2] - 与博通合作,两家去年10月签下10GW定制加速器大单 [2] - 量产2027年逐步爬坡,下一里程碑是100兆瓦,Gen2已在深度开发、Gen3正在成形,2026年底先部署进OpenAI自己的数据中心 [2] - SemiAnalysis判断“CUDA的护城河可能已经死了” [2] 英伟达竞争与合作关系 - 英伟达Rubin比Jalapeño早一个月完成CoWoS流片,但外界仅看到CoreWeave工程样片数据,英伟达未像OpenAI那样让第三方随意测试 [3] - 8月17日,英伟达同意为OpenAI俄亥俄州数据中心园区提供最高1050亿美元融资 [3] - OpenAI承诺2026年下半年部署首批1吉瓦英伟达Vera Rubin系统 [3] - OpenAI芯片负责人Richard Ho表示“英伟达是很好的合作伙伴,我们仍需要大量英伟达芯片” [3] - 英伟达财报前夜公布此消息,焦点包括Blackwell放量、Rubin进展及OpenAI算力承诺的会计处理 [4]
OpenAI首颗芯片,吊打英伟达
半导体行业观察· 2026-08-26 09:15
核心观点 OpenAI自主研发的Jalapeno推理芯片在性能测试中全面超越英伟达现有产品线,尤其在单位功耗性能和响应速度上表现突出,旨在降低AI推理成本并构建自主AI基础设施,但公司仍视英伟达为重要合作伙伴[2][3][6] 芯片性能与测试结果 - Jalapeno在单位功耗下可处理更多AI工作量,响应速度更快,竞争对手是英伟达GB300[2] - 在GPT-OSS 120B、DeepSeek R1和Kimi K2.5 1T三个公开模型上,Jalapeno峰值吞吐量下每瓦AI工作量是对比系统的1.5到1.9倍,端到端延迟降低1.7到3.6倍[8] - 高交互性工作负载性能提升2.1到4.1倍[8] - 在最大公开模型Kimi上,每瓦峰值性能比对比系统高出约1.5倍,端到端延迟降低约3.4倍[15][16] - 在内部测试中,Jalapeno在OpenAI前沿模型上的优势进一步扩大[16] - 芯片额定功率为700瓦,但测试中持续功耗保持在550瓦或以下[15] - 使用SemiAnalysis的公开基准测试工具InferenceX进行测试,衡量AI请求完整处理过程[9] - 在吞吐量、能效和延迟方面均表现更佳,单位功耗性能是更实用的标准[9] - Mixed-token吞吐量与现有加速器最快解码速度相匹配[10] 芯片设计与架构优势 - Jalapeno兼具高吞吐量和低延迟优势,现有硬件系统通常需在两者间权衡[3][7] - 设计围绕真实语言模型工作负载,将芯片、内存、网络、软件和机架级系统一体化设计[16] - 最大限度减少数据移动和通信延迟,模型状态可显式放置并保存在本地[17] - 网络是架构不可或缺部分,整个工作负载保持在一个连接系统内[17] - 支持不断变化的模型架构,在预填充和解码阶段均表现出色[17] - 目标应用是AI推理阶段,非训练模型设计[4] - 可处理更大目标,而Cerebras等技术更适合小型模型[5] 成本与部署计划 - 新芯片广泛应用将大幅降低OpenAI成本[3] - 计划今年晚些时候开始使用Jalapeno支持AI模型[2] - 计划年底前开始在OpenAI计算基础设施中部署Jalapeno[19] - 第二代芯片开发接近尾声,预计未来几个月内完成流片[6] - 第三代AI技术已在设计中,旨在降低全球AI基础设施成本[6] - 将加速Jalapeno部署,为客户提供更快、更强大、更高效的产品[9] 开发合作与AI辅助 - OpenAI与博通公司合作开发Jalapeno处理器[3] - 两家公司去年宣布合作,今年6月称赞开发速度创纪录[3] - 利用自主研发AI模型加快芯片开发速度[6] - AI帮助团队在九个月内完成从初始设计到流片[17] - AI优化芯片算术电路,集成更多计算性能[17] - 利用Codex和GPT-Astra,团队两个月内将三个开源权重模型实现高性能运行[18] - 对于选定的GPT-OSS注意力机制和混合专家模型模块,AI生成实现比人工专家编写快1.5到1.8倍[18] 行业竞争与市场定位 - OpenAI加入众多开发自主AI芯片公司行列,该领域由英伟达主导[2] - 其他初创公司如Etched(估值210亿美元)已出货低电压芯片,MatX研发高吞吐量低延迟半导体[5] - OpenAI仍视英伟达为重要芯片供应商和合作伙伴[6] - 将继续广泛部署英伟达及其他合作伙伴加速器用于训练和推理[20] - 短期内不会取代Cerebras等供应商,因计算需求巨大[5]
OpenAI首颗「辣椒」芯片压倒英伟达,GPT-6干崩CUDA
36氪· 2026-08-26 08:32
核心观点 - OpenAI首颗自研芯片Jalapeño在AI推理性能上全面反超英伟达GB200和GB300,实测速度显著领先[1] - OpenAI通过AI辅助设计(GPT-Astra)将芯片设计周期压缩至9个月,并形成了模型、芯片和软件协同优化的加速飞轮[15][20] - 英伟达的CUDA护城河可能因速度劣势而面临威胁,OpenAI的芯片路线图已规划至Gen2和Gen3,并签署10GW合作大单[21][27][29] 性能对比 - Jalapeño每秒可处理1459个Token,英伟达GB200仅535个,不到一半[1] - Jalapeño完成一个任务需1.65秒,GB300需近6秒,差距达3.6倍[1] - 在GB300最快解码速度(每秒169个Token)下,Jalapeño吞吐量是其104.3倍[8] - 在GPT-OSS 120B模型上,Jalapeño每瓦特AI工作负载提升1.5–1.9倍,端到端延迟降低1.7–3.6倍,高度交互工作负载性能提升2.1–4.1倍[6] - 三个模型上Jalapeño分别快2.7倍、4.1倍和3.8倍[7] - 按各自最佳工作点算峰值,差距为1.9倍、1.7倍和1.5倍[9] - 在GPT-OSS上,Jalapeño每兆瓦每秒吐出约5300万个Token,GB200 NVL72仅约1000万[11] 功耗与成本 - Jalapeño标称功耗700W,GB300为1400W,仅为一半[2] - 每颗芯片功耗:Jalapeño 1.125千瓦,GB200 1.87千瓦,Vera Rubin 3.3千瓦[11] - 每芯片每小时总拥有成本:Jalapeño 1.56美元,与H100的1.55美元几乎持平,Vera Rubin为3.61美元[12] - 每瓦HBM带宽:Jalapeño为22,第二名Rubin为11.1,GB300仅5.71[17] - 每瓦FLOPs:Jalapeño为19.1,Rubin为19.4,但Rubin功耗超1800瓦,Jalapeño仅700瓦[18] 设计制造 - 从设计到流片仅用9个月,业内常见周期为18-36个月[15] - 辅助设计模型GPT-Astra(外界传为GPT-6)帮助探索方案,使SIMD单元面积减少8%,矩阵引擎面积减少10%[15] - 主计算die约840平方毫米,接近EUV光刻机掩模版极限858平方毫米[16] - 当前为A0步进,B0已在晶圆厂,每瓦性能比A0再高约25%[19] - AI手敲代码在注意力模块和MoE模块上比人类顶尖专家快1.5到1.8倍[19] 行业影响 - 著名半导体分析师Dylan Patel称Jalapeño不仅超越Blackwell,还超越了英伟达Rubin芯片[2] - SemiAnalysis实测结论:Jalapeño干趴了此前测过的每一颗英伟达、AMD、谷歌芯片[3] - 英伟达Rubin比Jalapeño早一个月完成CoWoS流片,但外界仅看到CoreWeave工程样片数据[23] - SemiAnalysis判断CUDA护城河可能已死,原因在于速度[21][22] - 从零开始让OpenAI无需背负历史包袱,架构可完全按白纸设计[25] - OpenAI模型被用来设计威胁CUDA护城河的芯片,英伟达GPU正在催生自己的“接班人”[26] 未来规划 - OpenAI与博通签署10GW定制加速器合作大单,相当于十座核电机组满发[27][28] - Jalapeño为路线图第一代,Gen2已在深度开发,Gen3正在成形[29] - 量产要到2027年逐步爬坡,下一个里程碑是100兆瓦[29] - 数据中心大总管Chris Malone(负责“星际之门”项目)离职,引发对OpenAI内部动态的关注[30][31]
隔夜美股 | 传美伊就停火达成共识 三大指数收涨 英伟达(NVDA.US)涨超2%
智通财经网· 2026-08-26 06:26
宏观经济与地缘政治 - 美国与伊朗已就停火协议条款达成共识,内容包括霍尔木兹海峡的自由航行,双方预计将在未来几天内公布相关消息[1] - IMF总裁警告全球财政风险上升,呼吁各国控制债务赤字,并指出伊朗战争引发的能源冲击尚未结束,全球经济正面临“来自中东的负面供应冲击”和“人工智能带来的正面需求冲击”之间的拉锯[4] - 美国8月消费者信心指数下降0.8点至89.4,创年初以来最低水平,汽油价格高企和生活成本上涨继续施压美国家庭[9] 美股市场表现 - 周一三大指数收涨,道琼斯指数涨0.30%报53577.23点,标普500指数涨0.32%报7677.22点,纳斯达克综合指数涨0.66%报26151.30点[1] - SK海力士和美光科技涨超2%,英伟达涨2.1%,AMD涨近5%[1] - 纳斯达克中国金龙指数收涨1.1%,阿里巴巴涨0.8%[1] 全球市场表现 - 德国DAX30指数涨0.60%,英国富时100指数涨0.31%,法国CAC40指数跌0.16%[2] - 日经225指数涨0.5%,韩国kospi指数涨0.68%[2] - 美元指数下跌0.09%收于98.915,欧元、英镑兑美元上涨,日元兑美元下跌[3] - 比特币涨0.13%报78840美元,以太坊跌超1%报2449.16美元[3] - 纽约原油期货价格下跌3.12%至每桶82.36美元,布伦特原油期货价格下跌3.89%至每桶88.58美元[3] - 现货黄金报4658.71美元,现货白银报68.64美元[3] 美联储政策 - 美联储柯林斯目前支持维持利率不变,但若通胀不改善可能很快加息,她认为近期通胀数据“有点令人鼓舞”,但月度数据可能存在波动[6][7] 人工智能与科技行业 - 巴克莱警告AI基建扩张可能使相关交易面临政治风险,数据中心建设正让AI从抽象科技故事变成具体生活成本问题,AI数据中心指数包含超40家公司,相关股票可能面临政策压力[5] - 英伟达财报前瞻显示,市场期待的不只是“超预期”,还有增长路径和资本部署细节,英伟达未来12个月预期市盈率约21倍,约75%的毛利率将在投入成本上升背景下受到密切关注[10] - OpenAI自研Jalapeno芯片在测试中击败英伟达GB300,在单位功耗AI工作量和响应速度两个项目中领先,该芯片由OpenAI与博通合作开发[13][14] 内存与半导体行业 - 韩国DRAM 8月出口价格同比暴涨401%,达到每公斤9.2183万美元,较2023年1月低点上涨约12.5倍[8] - 高盛预计DRAM供应缺口将从今年的5.0%扩大至明年的5.9%,AI服务器所需的HBM和大容量服务器DRAM正在吸收有限生产产能[8] - TrendForce预计到明年底,三星、SK海力士和美光用于HBM生产的晶圆投入量将占DRAM总晶圆投入的30%,但HBM占实际DRAM比特供应量仅约13%[8] - SK海力士表示2027年可能成为“内存行业历史上最严重的短缺年份”,高盛预计供应短缺可能持续至2028年[8] 航天与太空行业 - SpaceX计划在路易斯安那州建设价值1000亿美元的星舰发射基地,占地约12.5万英亩,计划建设5个发射综合体、10个发射台[11] - 该基地将帮助SpaceX提高星舰发射频率,支持未来建设最多100万颗数据中心卫星的计划,星舰最早于2027年执行轨道数据中心任务,最早于2028年搭载NASA宇航员登月[11] AI公司IPO与估值 - Anthropic预计潜在市场规模超30万亿美元,超过SpaceX此前估计的28.5万亿美元,公司第二季度营收已超过116亿美元,较此前翻倍[12] - Anthropic此次IPO可能筹资高达1000亿美元,目标估值约2万亿美元,高于SpaceX上市时的1.77万亿美元,预计最快9月或10月上市[12]
OpenAI's new AI chip outperforms Nvidia's GB300 in efficiency tests, company says
Proactiveinvestors NA· 2026-08-26 00:02
公司背景与定位 - 编辑Angela Harmantas拥有超过15年北美股票市场报道经验,尤其专注于初级资源股,曾为加拿大、美国、澳大利亚、巴西、加纳和南非等国的领先行业出版物进行报道[1] - 该编辑此前在投资者关系领域工作,并曾为瑞典政府主导加拿大外国直接投资计划[1] - 出版商Proactive为全球投资受众提供快速、可访问、信息丰富且可操作的商业和金融新闻内容,所有内容由经验丰富的新闻记者独立制作[2] - Proactive新闻团队覆盖全球主要金融和投资中心,在伦敦、纽约、多伦多、温哥华、悉尼和珀斯设有分社和演播室[2] - 该公司专注于中小型市场,同时也关注蓝筹公司、大宗商品和更广泛的投资故事,内容涵盖生物科技与制药、矿业与自然资源、电池金属、石油与天然气、加密货币与新兴数字及电动汽车技术[3] 内容生产与技术应用 - Proactive采用前瞻性技术,其人类内容创作者拥有数十年的宝贵专业知识和经验,团队也使用技术来辅助和增强工作流程[4] - 该公司偶尔会使用自动化和软件工具,包括生成式AI,但所有发布的内容均由人类编辑和撰写,符合内容生产和搜索引擎优化的最佳实践[5]
今夜,利好突袭!光通信、存储芯片集体大涨
中国基金报· 2026-08-26 00:00
市场整体表现 - 美股三大指数集体上涨,但盘中高开低走,纳斯达克100指数盘初一度涨超1%,现涨约0.6% [2] - 费城半导体指数盘初涨超2%,现涨约1.5% [2] 科技板块与个股 - 光通信、存储芯片板块反弹,迈威尔科技涨超6%,应用光电涨超5%,Lumentum大涨4%,存储芯片板块普遍涨超2% [4] - 迈威尔科技最新价243.65,涨跌幅+6.26% [5] - 应用光电最新价113.18,涨跌幅+5.15% [5] - 超威半导体最新价479.13,涨跌幅+4.90% [5] - 戴尔科技最新价453.10,涨跌幅+4.60% [5] - Lumentum最新价865.00,涨跌幅+4.20% [5] - Coherent Corp.最新价285.73,涨跌幅+3.72% [5] - 希捷科技最新价822.51,涨跌幅+3.51% [5] - SpaceX最新价138.88,涨跌幅+2.87% [5] - Applovin最新价306.56,涨跌幅+2.67% [5] - SK海力士最新价159.19,涨跌幅+2.46% [5] - 美光科技最新价932.83,涨跌幅+2.46% [5] - 安谋最新价244.66,涨跌幅+2.46% [5] - CoreWeave最新价88.25,涨跌幅+2.32% [5] 能源与宏观因素 - 油价大跌超3%,带动美债收益率回落,布伦特原油跌破每桶90美元 [6] - 美国国务院准备将撤离的外交官送回中东,缓解市场对伊朗战争升级的担忧,进一步打压油价 [6] - 能源价格下降缓解通胀压力,推动美国国债上涨、收益率下行 [7] 经济数据与美联储 - 消费者信心降至今年年初以来最低水平,因对商业环境和就业市场前景看法恶化 [9] - 投资者等待周三公布的美联储最关注的通胀指标 [9] - 美联储主席凯文·沃什周五将发表讲话,可能影响债券市场走势 [10] - 分析师认为沃什更可能坚持立场,英伟达财报和业绩指引能否获得积极市场反应变得非常重要 [10] 英伟达与AI芯片竞争 - 分析师预计英伟达上一季度营收较上年同期接近翻倍,达到920亿美元,超过任何竞争对手一整年营收 [10] - 分析师指出英伟达目前几乎火力全开,但仅交出“好消息”已不够,财报解读出现任何偏差或失误都可能给股价带来巨大挑战 [10] - OpenAI表示其新推出的Jalapeno芯片在测试中优于英伟达当前一代产品GB300,显示自研AI处理器取得明显进展 [11] - OpenAI计划从今年晚些时候开始使用Jalapeno芯片支持AI模型,越来越多科技公司开发自研AI芯片 [14] - 英伟达总市值5.11万亿,总股本242.00亿,市盈率(TTM)31.99 [12] 其他板块 - 疫苗巨头Moderna股价暴涨超14% [14] - Moderna最新价159.20,总市值634.06亿,总股本3.99亿,每股收益-7.89 [15]
OPENAI称其JALAPENO芯片在速度和功耗方面都超越了英伟达的GB300
华尔街见闻· 2026-08-25 22:03
核心观点 - OpenAI宣称其自研的JALAPENO芯片在速度和功耗两方面均超越英伟达的GB300芯片 [1] 芯片性能对比 - JALAPENO芯片在速度上超越英伟达GB300 [1] - JALAPENO芯片在功耗表现上优于英伟达GB300 [1]