Workflow
国泰海通|电子:Deepseek R1更新,商业场景拓展加速
国泰海通证券研究·2025-06-02 20:31

Deepseek R1模型性能升级 - 深度思考能力对标国际顶尖模型OpenAI-o3和Gemini-2-5-Pro-0506 在数学、编程与通用逻辑等多个基准测评中整体表现接近[3] - 蒸馏训练性能显著提升 基于Deepseek-R1-0528思维链训练的Qwen3-8B Base模型在AIME2024数学测试中性能仅次于原模型 与Qwen3-235B相当[3] - 幻觉率降低45-50% 在改写润色、阅读理解等场景表现优化 同时支持议论文、小说等文体的长篇内容生成及工具调用[3] 商业化应用前景 - 性能迭代有望提升用户渗透率和使用频次 带动国产算力产业链需求增长[4] - 蒸馏模型在端侧设备表现优异 加速大模型在手机、PC、眼镜等终端设备的落地应用[4] 行业影响 - 模型更新被视为行业催化剂 推动国产大模型技术持续迭代[5] - 技术突破可能重塑AI赋能终端设备的竞争格局[4]