大模型专题点评:MiniMax H3 开源,模型竞争迈向生产力
华创证券·2026-08-06 23:12

报告行业投资评级 - 计算机行业评级为“推荐”(维持)[3] 报告核心观点 - 国产大模型已进入推理效率和开源生态并重的新阶段,行业竞争从单纯提升智能上界转向模型分层、全模态生成、Agent执行能力和单位任务成本的综合比拼[2][7] 根据相关目录分别总结 MiniMax H3 开源事件与模型能力 - MiniMax 正式开放 H3 基础模型权重,H3 能够统一理解文本、图像、视频和音频构成的多模态上下文,并生成最长15秒、最高2K分辨率、带原生立体声音频的视频[2][7] - H3 允许用户直接用自然语言描述素材之间的关系,在同一模型内完成主体保持、动作迁移、声音参考及内容编辑,将文生视频、图生视频、动作参考、音色参考和视频编辑等独立任务统一[7] - 视频模型的竞争正在从单次素材生成,转向理解完整创作意图并参与广告、电商、游戏和设计等生产流程[7] H3 架构与效率优势 - H3 通过 Contextual Omni Representation 建立不同素材与目标内容之间的关系,采用33B参数的单流 H3-Omni Transformer 联合预测视频与音频[7] - H3-VAE 的高压缩率带来4倍序列长度收益,理解与生成异构训练架构使端到端训练吞吐提升近30%[7] - 在2K输出环节,H3将768p结果与原始上下文重新输入基模完成再生成,以提高小文字与精细内容的还原能力[7] - H3的关键不只是提高分辨率,而是通过模型、数据和Infra协同,将复杂全模态生成转化为可规模使用的低成本产品[7] 开源策略与生态扩散 - 本次开放以 H3-Base 为核心,支持文生音视频、首尾帧生成和全模态参考生成,并兼容 SGLang、vLLM、Diffusers 和 ComfyUI 等主流部署框架[7] - 负责复杂输入编排的 H3-Context-IR 及负责2K再生成的 H3-Regenerate-2K 暂通过官方 API 提供[7] - 开放后24小时内,华为昇腾、摩尔线程、沐曦、海光、AMD、Intel 等9家芯片厂商完成 Day 0 适配,超过100家开发者社区、云推理平台和企业完成接入[7] - “开放基础模型+保留高价值编排与高清服务”既能扩大生态影响力,也为API调用和企业服务保留清晰的商业化入口[7] 行业竞争格局与近期动态 - OpenAI 于7月30日将 GPT-5.6 Luna 价格下调80%、Terra 下调20%,调整后 Luna 每百万输入 Token 0.20美元、每百万输出 Token 1.20美元;Terra 每百万输入 Token 2美元、每百万输出 Token 12美元;Sol 价格保持不变[7] - Anthropic 于7月24日推出 Claude Opus 5,支持1M上下文和128K输出,定价为5/25美元,重点强化复杂 Agentic Coding 和企业任务[7] - 国内方面,Qwen 于8月3日上线2.4T参数、1M上下文的 Qwen3.8-Max;DeepSeek-V4-Flash-0731 于8月1日上线,以284B总参数、13B激活参数和1M上下文主攻高并发低成本场景[7] - 行业竞争已经从单纯提升智能上界,转向模型分层、全模态生成、Agent执行能力和单位任务成本的综合比拼[7] 投资建议与关注方向 - 报告建议关注国产算力:寒武纪、海光信息、沐曦股份、天数智芯、壁仞科技、摩尔线程[7] - 报告建议关注大模型:智谱、MiniMax[7] - 报告建议关注超节点:浪潮信息、中科曙光、紫光股份[7] - 报告建议关注AI+工业:中控技术、海康威视、索辰科技、鼎捷数智、容知日新[7] - 报告建议关注AI Infra:达梦数据、海天瑞声[7] - 报告建议关注AI4S:华兰股份、英矽智能、晶泰控股、剂泰科技[7] - 报告建议关注AI+Coding:卓易信息[7]

大模型专题点评:MiniMax H3 开源,模型竞争迈向生产力 - Reportify