核心观点 - Anthropic发布的Claude Opus 5.5在性能大幅跃升的同时将运行成本压低40%[2] - 谷歌工程师Patrick推测Opus 5.5可能由Anthropic内部更强的教师模型Model 2通过知识蒸馏训练而成[2] - 该事件将三条趋势串联:更强的内部模型迭代、AI深度介入AI研发、更小更便宜的产品模型涌现[3] - 如果该路径成立,模型能力提升与推理成本下降可能同时发生[4][18] Opus 5.5性能与成本 - Opus 5.5被定位为5.5系列首款发布,性能在多数任务上与Claude Fable 5.1持平[6] - 运行成本较Opus 5下降40%,输出速度提升逾30%[6] - 输入和输出token价格分别为每百万4美元和20美元,较Opus 5下降20%[6] - 缓存读取价格从每百万0.50美元降至0.20美元,降幅达60%[6] - 早期测试者完成680,000行代码迁移耗时不足一天,此前类似工作需要工程团队数周[7] - 另一测试中Opus 5.5将Web应用全站页面加载时间优化成功率达到39/40,Opus 5出现副作用[7] - 将HAProxy从C语言重写为Rust的内部测试中,Opus 5.5耗时9.5小时,较Fable 5.1的12小时缩短逾20%,成本节省51%[8] - Opus 5.5每个token价格更低,完成同等任务所需token数量也更少,两者叠加形成40%综合成本降幅[8] 教师模型与蒸馏技术 - Patrick推测Opus 5.5由更大的教师模型训练,很可能是Model 2 Mythos[10] - Opus 5.5是首个经过RSI训练、同时由内部教师模型蒸馏的模型[10] - 模型蒸馏让能力更强的教师模型生成高质量训练信号,再用这些信号训练更小的学生模型[10] - Anthropic已公开确认内部存在比Mythos 5更强大的Model 2,被大量用于代码生成、数据生成及代理任务[10] - 目前无公开材料直接证明Opus 5.5由Model 2蒸馏而来,Anthropic发布文档未提及具体训练方式[10] - Anthropic在安全条款中将蒸馏攻击单独列为一类威胁,并在Opus 5.5上引入保留推理链等反蒸馏机制[10] - 蒸馏技术在Anthropic技术体系中具有相当重要的地位[11] AI参与AI研发的深化 - 截至2026年5月,Anthropic代码库中逾80%代码由Claude撰写[14] - 2025年2月Claude Code推出研究预览版之前,该比例仅为个位数[14] - Anthropic工程师人均每日合并代码量较2024年增长约8倍[15] - 2026年4月,Claude在约800小时内将某类API错误降低1000倍,人工完成同等任务需约四年[16] - 内部测试显示,2025年11月的Opus 4.5模型在51%情况下给出比人类更优的下一步建议[16] - 2026年4月的Mythos Preview该比例升至64%[16] - 在选择哪些问题值得研究方面,Claude与人类之间仍存在较大差距[17] - 完全意义上的递归自我改进目前尚未实现,也并非必然到来[18]
当AI开始“自己教自己”:Opus 5.5是首个RSI训练出的大模型?
硬AI·2026-09-23 22:51