Workflow
Large language model training
icon
搜索文档
DeepSeek 大举押注华为芯片以绕过美国出口管制 —— The Information --- DeepSeek Bets Big on Huawei Chips to Bypass U.S. Export Controls — The Informa
2026-09-21 22:47
电话会议纪要关键要点总结 一、涉及的公司与行业 * **公司**:DeepSeek(深度求索)、Huawei Technologies(华为技术有限公司)、Nvidia(英伟达)、Moonshot AI(月之暗面)、Anthropic、OpenAI [4][5][13][17] * **行业**:人工智能(AI)芯片、AI大模型训练、半导体硬件、美国出口管制 [6][8] 二、核心观点与论据 1. DeepSeek 战略转向国产芯片 * DeepSeek CEO 梁文锋明确将使用华为芯片或其他国产处理器训练模型列为公司“最大的赌注之一”,并强调这一努力“必须成功” [11][12] * DeepSeek 在 AI 模型训练过程中越来越多地采用华为芯片,旨在与美国对先进芯片的出口管制“脱钩” [6][7] * 梁文锋认为华为芯片在“几年内”就能达到与英伟达相当的水平,DeepSeek 应主动适应英伟达主导地位之外的半导体硬件 [13] * DeepSeek 从去年(2025年)开始尝试使用更多华为芯片,原因是英伟达先进芯片持续面临限制 [13] 2. 华为芯片交付时间表与产品路线 * 华为最早将于2026年第四季度开始向 DeepSeek 交付训练芯片 [4][5] * 梁文锋预计在2026年第四季度或2027年第一季度收到一批新的华为芯片,可用于训练最新模型 [11][12] * 华为产品路线图显示:Ascend 950DT(专为训练及部分推理设计)预计2026年第四季度上市,更强大的 Ascend 960DT 计划于2027年第一季度推出 [22] * 华为在2026年4月已表示其 AI 芯片承担了 DeepSeek 较小规模模型 V4-Flash 的部分训练工作,且双方已合作使 V4 模型系列适配华为 Ascend 计算系统 [23] 3. 芯片供应与性能对比 * 训练一个规模堪比 OpenAI 顶级系统的模型,大约需要5万颗英伟达 GB300 处理器或20万颗华为昇腾950芯片 [19][20] * 华为因先进内存(允许 AI 处理器快速移动大量数据的关键组件)及其他组件短缺,遭遇生产限制 [21] * 梁文锋未详细说明华为能为 DeepSeek 提供多少供应量 [12] * DeepSeek 仍在通过黑市获取英伟达芯片用于训练新模型,短期内无法完全摆脱对英伟达硬件的依赖 [15] 4. 模型规模与算力投资 * DeepSeek 目前正在训练一个拥有2万亿参数的模型,大于其现有 V4 旗舰模型的1.4万亿参数 [17][18] * 公司计划开发一个拥有8万亿参数的超大规模模型 [17][18] * 相比之下,Moonshot AI 的 Kimi K3 模型拥有2.8万亿参数,Anthropic 和 OpenAI 的最新模型参数规模至少数万亿级别 [17][18] * 公司正投入约300亿元人民币(30 billion yuan)来扩大算力 [15] * DeepSeek 于2026年6月筹集了500亿元人民币(50 billion yuan) [15] 5. 融资与估值 * DeepSeek 正在进行第二轮融资,目标是以5000亿元人民币(500 billion yuan)的估值筹集500亿元人民币(50 billion yuan,约75亿美元) [6][7] * 2026年5月梁文锋与投资者的视频通话记录泄露,导致公司暂停第二轮融资进程一周 [9][10] * 为防泄密,2026年9月的闭门会议要求投资者前往北京或杭州办公室,上交手机、电子设备及包袋,仅提供纸笔记录 [9][10] 三、其他重要但可能被忽略的内容 * 梁文锋在2026年9月20日(周日)的闭门线下会议上发表上述言论,投资者通过线上方式接入 [4][7][9] * 会议纪要真实性已获《The Information》证实 [19][20] * DeepSeek 和华为未立即回应置评请求 [12] * 模型规模越大,训练和推理所需的芯片和算力就越多 [18] * 华为在2026年4月已公开确认与 DeepSeek 在 V4 模型系列上的合作适配工作 [23]