核心观点 - 阿里发布并开源全新架构千问模型Qwen3.8-Flash,以极致性价比和性能创下全球模型效率新基准 [2] 模型性能与架构 - Qwen3.8-Flash采用下一代MoE架构,总参数125B仅激活6B,性能超越Claude Opus4.6、接近Opus4.8 [3] - 基座模型在通用(SuperGPQA)、数学推理(GSM8K)、编程(SWEBench-Pretrain)等基础能力上超过3倍大小的Qwen3.7-Plus基座模型 [3] - 后训练后性能跃迁:SWE-bench Pro评测领先Opus4.6达9.1分 [3] - 智能体任务中超越DeepSeek-V4-Flash,JobBench智能体评测超出Opus4.6近20分 [3] - 多模态能力显著更强:AndroidWorld比Opus4.6高22.5分,MathVision超出25.1分,ERQA领先31.5分 [4] - 引入独特QSA机制与GDN融合的混合注意力架构,1M Tokens长上下文场景可提速8倍以上 [5] - 引入自研Gated Residual方法,将信息主通道从1条拓展为4条 [5] - 引入51B的N-gram Embedding参数,以极低资源外挂大规模“记忆指南手册” [5] 成本与性价比 - 训练成本较Qwen3.7-Plus骤降近90%,仅用九分之一资源完成训练 [2][6] - 推理成本大幅下降:每百万Tokens输入仅1元,输出3元 [2] - 价格最低至DeepSeek-V4-Flash的1/3,是Claude Opus4.6的3% [2][6] - 是DeepSeek-V4-Flash闲时价格的2/3、忙时价格的1/3 [6] 应用与开源 - Qwen3.8-Flash于8月26日晚间首发上线“千问办公”,开发者和企业可通过千问AI平台获取API服务 [2] - “千问办公”标准模式内置Qwen3.8-Flash,可完成95%日常办公任务 [6] - Next新架构是新一代千问大模型Qwen4的雏形 [7] - Qwen3.8已开源发布2.4T参数量的Qwen3.8-Max、Qwen3.8-27B及Qwen3.8-Flash三大尺寸模型 [7] - Qwen模型全球下载量突破30亿次,衍生模型数超30万个 [7]
阿里开源发布Qwen3.8-Flash,创下模型效率的全球新基准