Workflow
新“SOTA”推理模型避战Qwen和R1?欧版OpenAI被喷麻了
量子位·2025-06-11 13:13

然而再一次遭到网友质疑:怎么又不跟最新版Qwen和DeepSeek R1 0528对比? (此前该公司发布Ministral 3B/8B时,声称"始终优于同行",却没有对比Qwen2.5) 闻乐 发自 凹非寺 量子位 | 公众号 QbitAI "欧洲的OpenAI"Mistral AI终于发布了首款推理模型—— Magistral 。 在该模型发布的前几个小时,Mistral AI的CEO Arthur Mensch在接受炉边访谈时声称即将发布的Magistral能够与其他所有竞争对手相抗 衡。 在官方展示的基准测试结果中, DeepSeek-R1 的数据确实不是最新的 (在AIME-25数学测试中,DeepSeek-R1-0528的准确率已经从旧 版的70%提升至87.5%) ,并且比较行列里完全不见 Qwen 的身影。 不过,与同公司初期模型 Mistral Medium 3 相比,该框架在AIME-24上的准确率提升了50%。 此次Magistral发布了两种版本: Magistral Small ——24B参数的开源权重版本,可在Apache 2.0许可下自行部署。 Magistral Medium ...