OpenAI links China's Moonshot AI to attempt to extract its models' reasoning
CNBC·2026-10-01 08:04

事件核心 - OpenAI识别并破坏了一场协同行动 该行动试图从其人工智能模型中提取受保护的推理过程 并将该活动的核心集群与中国初创公司Moonshot AI(Kimi开发者)关联 [1] - 该活动始于7月初 后在两天内激增至来自超过4000名用户的16000次请求 OpenAI最终识别出涉及超过15000名用户的相关活动 并称已在7月28日完全破坏该行动 [2] - 该发现出现前几周 OpenAI竞争对手Anthropic指控包括Moonshot AI和阿里巴巴在内的多家中国AI开发者秘密使用其Claude模型帮助训练自身AI系统 凸显美国AI公司对竞争对手可能利用其模型更快更便宜地开发竞争技术的担忧日益加剧 [3] 操作手法与性质 - OpenAI将最新活动描述为“对抗性蒸馏” 即利用一个AI模型的输出或推理来帮助训练或改进另一个模型 [4] - 提取此类推理可能使他人无需对前沿模型的开发和安全保障进行同等投资即可复制先进能力 构成潜在安全和国家安全风险 [4] - 操作者未突破OpenAI的加密 数据库或存储的用户对话 而是操纵与其模型的交互 试图以请求者可见的形式复制隐藏推理 [5] 归因与应对 - OpenAI称尚不清楚所有涉及的操作者是否与单一行为者有关 但将核心活动集群归因于与Moonshot AI相关的个人 [6] - OpenAI表示已通过Frontier Model Forum以及政府信息共享渠道与其他AI开发者分享了调查结果 [6] - Moonshot未立即回应CNBC的置评请求 [6]

OpenAI links China's Moonshot AI to attempt to extract its models' reasoning - Reportify