Workflow
Tenet
icon
搜索文档
OpenAI投的700亿AI独角兽,靠中国大模型“托底”
第一财经· 2026-08-26 19:57
核心观点 - 美国法律AI独角兽Harvey选择中国开源模型Kimi K3作为底座,通过后训练打造专属法律模型Tenet,验证了垂直行业基于开源模型自研专有模型的产业路径[1][5] - 开源模型叙事从“更便宜的替代方案”转向让垂直行业公司能够真正“拥有”自己的模型,将专业数据、专家经验和业务流程转化为模型能力[7] Harvey与Tenet模型 - Harvey估值达110亿美元(约700亿人民币),服务全球2400余家机构,覆盖数十万名律师[1] - Harvey的种子投资人为OpenAI创业基金,此前长期基于硅谷顶尖闭源模型构建服务,但自研第一个模型底座为Kimi K3[5] - Tenet基于Kimi K3进行异步强化学习后训练,针对长周期、agentic法律任务优化,用开源模型提供基础能力,用自己的数据和专家经验定义专业标准[5] - 训练侧搭建约1750个智能体任务环境,完整模拟大型律所真实工作流,单次运行可超过1000轮对话、消耗数十万token[5][6] - 训练在150张NVIDIA B300 GPU上持续两个月,每轮训练完成超过10000次完整任务轨迹采样[6] - 评测采用“全通过”指标,任务在事实、结论、引用、截止日期等每一条评分细则都达标才算成功,漏掉任何关键风险点即判定整体失败[6] - Tenet在自建基准上全通过率提升9个百分点,几乎翻倍;在合同审查子项取得当前最优性能,整体排名第二;在未见过的外部基准上保持强劲泛化表现[6] - Tenet性能提升来自基于K3底座的垂直领域后训练,证明Kimi K3作为基座模型具备极高的“可塑性”和“后训练潜力”[6] Kimi K3模型特性 - Kimi K3为月之暗面发布的稀疏混合专家(MoE)模型,总参数达2.8万亿,每token激活约1040亿参数,拥有896个路由专家和100万token超长上下文窗口[5] - Kimi K3凭借强大的长上下文能力和MoE架构的效率,成为垂直行业后训练路径中最具吸引力的起点之一[11] 产业路径与趋势 - Harvey提供完整示范:基座为Kimi K3提供前沿通用能力[8];数据包括公开法律数据、合成数据、人类专家数据(未使用客户数据)[9];方法为异步强化学习、GSPO优化,奖励函数同时优化质量和成本效率[9];标准为自建LAB基准和专家rubric[10] - Harvey通过reward shaping激励高效工具使用和推理,偏好在同等性能下消耗更少token的轨迹,Kimi K3等开源模型的token价格优势加上后训练带来的token效率优化,形成双重成本优势[11] - 基础模型层竞争正在商品化,对垂直行业公司而言“选哪个基座”正在变成工程决策[11] - AI竞争从“谁能写代码”进入“谁能理解并重构专业知识工作”的阶段,专业知识工作可以被系统化、被量化、被训练进模型[11] - 闭源API模式下行业公司只能做prompt engineering、RAG和应用层封装,模型本身是别人的,无法把业务标准训练进模型权重[12] - 对于专业知识密集、数据敏感、需要长期迭代的垂直行业,“基座开源+行业后训练”成为越来越有吸引力的路径[12] - 此前AI编程领头羊Cursor以Kimi K2.5为基座训练自己的编程模型,AI工程师Devin开发商基于Kimi K2.7 Code模型开发SWE-1.7模型[12] - 领先的中国开源模型越来越像Android成为手机系统基座一样,成为AI时代的世界创新基座[12]
OpenAI「亲儿子」反水,认中国模型做「赛博义父」
36氪· 2026-08-26 17:25
文章核心观点 - 一批美国AI产品(如Cursor、Harvey、Devin)使用中国模型(如Kimi)作为基座进行后训练,形成“美国产品、中国模型”的供应链模式 [4][16][23] - 中国开源模型为AI创业公司提供了第三条路:无需从头训练或依赖闭源模型,而是直接获取预制模型进行定制化加工 [26] - 中国模型正从开放权重、合成数据到直接部署,以不同形式进入美国AI产品的供应链,成为“原料、底座和上游工业品” [31] 法律AI领域:Harvey与Kimi K3 - Harvey是一家估值110亿美元的法律AI公司,服务超过1300家机构和10万名律师,成立仅四年 [10] - Harvey发布专门法律模型Tenet,以Kimi K3为基座,这是其第一个基于开放权重进行后训练的模型 [8][10] - Tenet在Harvey法律智能体基准LAB上,成功完成的测试任务接近底座模型的两倍 [10] - 通用模型能回答法律知识,但无法完成真实法律任务,律师需要模型判断从哪里开始、连续检索和阅读材料、发现风险并给出引用 [11][13] - 真正稀缺的是知道工作如何完成和检查,这些无法靠提示词和外部工作流完整传递,只能通过训练解决 [13][14] 编程AI领域:Cursor、Devin与Cosine - Cursor是全球最热门的AI编程工具,估值数百亿美元,其模型Composer 2在Kimi K2.5基础上训练,后续Composer 2.5仍沿用Kimi底座 [16][18] - Cursor第一次推出“自己的模型”并非从零开始,而是直接拿Kimi开放模型继续加工 [18] - 英国AI公司Cosine拿Kimi K2.6训练出Lumen Outpost,专门维护银行、航空公司和大型企业的古老代码 [19] - Cosine体量远小于Cursor,但小公司没有钱与OpenAI、Google竞争,可直接拿中国模型专门训练解决客户愿意付费的问题 [21] - “全球第一位AI程序员”Devin发布SWE-1时公开承认使用Kimi K2.7 [21] - 短短半年,Kimi不同版本被海外公司依次拿走:K2.5进入Cursor,K2.6被Cosine改造,K2.7进入Devin,K3被Harvey训练成法律专家 [23] 中国模型对AI创业生态的影响 - 过去AI创业公司只有两条路:要么花费巨资从头训练模型,要么接入Claude、GPT等闭源模型并每次付费 [26] - 后一种办法导致产品做得越大、用户越多,付给上游模型公司的费用也越高,支出收入难以打平 [26] - 中国开源模型爆发提供了第三条路:直接拿到已训练好的模型,用自己的数据和业务经验继续加工 [26] - 这些公司不需要承担从零造模型的全部成本,也不用永远依赖Anthropic、OpenAI的定价和服务 [26] - 美国AI产品由中国模型预制,形成“美国产品、中国模型”现象 [27] - OpenAI前CTO Mira Murati创办的Thinking Machines(估值超120亿美元),一方面参考DeepSeek V3做模型架构,另一方面使用Kimi K2.5生成的合成数据启动监督微调 [28] - 中国模型正在以开放权重、合成数据、直接部署等不同形式进入美国AI产品的供应链 [31] - 很多用户不知道底层模型来自中国,但这说明中国模型正在获得“长期主义”价值:成为其他AI产品的原料、底座和上游工业品 [31]