NVIDIA Vera Rubin NVL72
搜索文档
CRWV's Vera Rubin Push: Can AI Infrastructure Fuel Its Growth Engine?
ZACKS· 2026-10-02 22:21
核心观点 - CoreWeave正将自身定位为面向下一阶段AI的更广泛基础设施平台 最新公告围绕NVIDIA Vera CPU和NVIDIA Vera Rubin NVL72展开 显示其向支持代理式AI 强化学习和日益复杂推理工作负载的方向转变 [1] - 代理式AI系统运行方式与传统推理工作负载不同 AI代理可能反复推理 调用工具 执行代码 与数据交互并评估自身输出 每个步骤在GPU使用之外都会产生大量CPU需求 NVIDIA Vera CPU专为这一新兴工作负载特征设计 其平台将以裸金属方式提供Vera 并采用与其余基础设施相同的运营模式和经济模型 [2] - Vera机架可包含128个CPU和11264个核心 理论上支持超过11000个并发隔离环境 CoreWeave报告测试显示 与x86 CPU相比 代理沙箱启动时间快三倍以上 CoreWeave的Sandboxes产品旨在使这些环境更易于配置 同时提供硬件隔离 CoreWeave更广泛的机会不仅在于将加速器小时数变现 还在于将围绕每个AI工作负载的CPU密集型基础设施变现 [3] NVIDIA Vera Rubin对CoreWeave GPU优势的影响 - 第二项公告可能对CoreWeave的竞争定位产生更大影响 公司宣布NVIDIA Vera Rubin NVL72可用 Cognition成为其首个生产客户 Cognition在CoreWeave上进行训练 强化学习和推理 [4] - 根据Cognition在CoreWeave上的测试 Vera Rubin NVL72在SWE-2推理工作负载中相较GB200 NVL72基线实现最高4.8倍的总token吞吐量提升 在强化学习工作负载中实现3.8倍的输出token吞吐量提升 同时加快研发周期 并可能降低每次AI会话成本 这些数字凸显了快速获取NVIDIA新架构对CoreWeave可能具有的商业重要性 [4] - 如果代理式应用成为AI的主要增长类别 Cognition等客户可能成为CoreWeave支持需要紧密集成计算资源工作负载能力的重要示范 公司还强调其全栈平台 包括CoreWeave Kubernetes Service SUNK Mission Control CoreWeave Sandboxes和无服务器推理 [5] 竞争格局与行业动态 - Nebius继续看到其AI云基础设施的强劲需求 该季度完成四笔里程碑式交易 平均价值超过10亿美元 这些协议收益率为每MW 2000万至2500万美元 预付款覆盖相关资本支出的50%至60% 与CRWV一样 NBIS继续深化与NVDA的关系 6月宣布计划投资约17亿英镑扩大英国AI计算容量 [7] - 该投资包括三个新的先进NVIDIA驱动基础设施部署 Nebius于2025年底在英国首次部署NVIDIA Blackwell Ultra基础设施 在此基础上 计划在英国建立三个额外站点 部署最新一代NVIDIA全栈AI工厂平台技术 这些部署预计于2027年全面运营时提供65 MW的AI计算容量 [8][9] - 微软正在利用AI业务势头和Copilot采用 同时加速Azure云基础设施扩张 其AI投资正在整个技术栈中转化为可衡量的商业牵引力 多模型灵活性 加上根据延长至2032年的IP安排继续访问OpenAI的前沿模型 使客户能够优化成本和性能 同时使微软保持在其AI基础设施决策的核心位置 微软于2026年8月收到NVIDIA首款量产Vera Rubin GPU 并于2026年6月完成首个Mount Pleasant数据中心设施 表明基础设施扩张正在推进 但也说明支持需求所需的投资规模 [10]