8月7日,华创证券在计算机行业大模型专题点评中指出,MINIMAX H3开源,模型竞争迈向生产力。
近日,MiniMax 正式开放H3基础模型权重。
任务与模态实现统一,视频模型正从生成工具迈向通用创作系统。H3能够统一理解文本、图像、视频和音频构成的多模态上下文,并生成最长15秒、最高2K 分辨率、带原生立体声音频的视频。与传统模型将文生视频、图生视频、动作参考、音色参考和视频编辑拆分为多个独立任务不同,H3允许用户直接用自然语言描述素材之间的关系,在同一模型内完成主体保持、动作迁移、声音参考及内容编辑。我们认为:视频模型的竞争正在从单次素材生成,转向理解完整创作意图并参与广告、电商、游戏和设计等生产流程。
架构全面服务任务泛化,效率优势构成H3商业化的重要底座。H3通过Contextual Omni Representation 建立不同素材与目标内容之间的关系,采用33B参数的单流H3-Omni Transformer 联合预测视频与音频;H3-VAE 的高压缩率带来4倍序列长度收益,理解与生成异构训练架构则使端到端训练吞吐提升近30%。在2K 输出环节,H3将768p 结果与原始上下文重新输入基模完成再生成,以提高小文字与精细内容的还原能力。我们认为:H3的关键不只是提高分辨率,而是通过模型、数据和Infra 协同,将复杂全模态生成转化为可规模使用的低成本产品。
开放基础模型加快生态扩散,MiniMax 正在探索开源与商业化协同。本次开放以H3-Base 为核心,支持文生音视频、首尾帧生成和全模态参考生成,并兼容SGLang、vLLM、Diffusers 和ComfyUI 等主流部署框架;负责复杂输入编排的H3-Context-IR 及负责2K 再生成的H3-Regenerate-2K 暂通过官方API 提供。开放后24小时内,华为昇腾、摩尔线程、沐曦、海光、AMD、Intel 等9家芯片厂商完成Day 0适配,超过100家开发者社区、云推理平台和企业完成接入。我们认为:“开放基础模型+保留高价值编排与高清服务”既能扩大生态影响力,也为API 调用和企业服务保留清晰的商业化入口。
近两周模型集中上新,性能升级与价格下探正在同步加速。OpenAI 于7月30日将GPT-5.6 Luna 价格下调80%、Terra 下调20%,调整后,Luna 则为每百万输入 Token 0.20美元、每百万输出 Token 1.20美元;Terra 的 API 价格为每百万输入 Token 2美元、每百万输出 Token 12美元;Sol 的价格保持不变。Anthropic 于7月24日推出Claude Opus 5,支持1M 上下文和128K 输出,定价为5/25美元,重点强化复杂Agentic Coding 和企业任务。国内方面,Qwen 于8月3日上线2.4T 参数、1M 上下文的Qwen3.8-Max;DeepSeek-V4-Flash-0731于8月1日上线,以284B 总参数、13B 激活参数和1M 上下文主攻高并发低成本场景。我们认为:行业竞争已经从单纯提升智能上界,转向模型分层、全模态生成、Agent 执行能力和单位任务成本的综合比拼。
投资建议:国产大模型已进入推理效率和开源生态并重的新阶段,建议关注:国产算力:寒武纪、海光信息、沐曦股份、天数智芯、壁仞科技、摩尔线程;大模型:智谱、MiniMax;超节点:浪潮信息、中科曙光、紫光股份;AI+工业:中控技术、海康威视、索辰科技、鼎捷数智、容知日新; AI Infra:达梦数据、海天瑞声;AI4S:华兰股份、英矽智能、晶泰控股、剂泰科技;AI+Coding:卓易信息。
风险提示:技术进展不及预期;模型落地不及预期;商业落地不及预期。