2026年8月4日,国盛证券(002670)发布了一篇传媒行业的研究报告,报告指出,AI产业研究系列|模型跟踪-MiniMax/H3-开源兼具高性价比,商业场景表现出色。
报告具体内容如下:
事件:7月31日,MiniMax发布新一代多模态生成模型MiniMaxH3;8月3日,MiniMax宣布H3正式开源。 点评: H3为通用全模态生成模型,统一处理文/图/视/音多模态输入,输出原生双声道音视频,上限15秒、2K分辨率。能力规格上,H3支持多种宽高比、24FPS帧率与32kHz立体声输出,稳定支持中、英、日、韩等11种语言;交互方式上,既支持纯文本、首帧、尾帧及首尾帧驱动的生成,也支持最多9张图像、3段视频、3段音频(合计12个文件)的全模态参考输入,同时引入图片、声音、视频等多模态信息源时,H3可自动完成复杂的全模态理解与创作。截至8月3日,据ArtificialAnalysis排名,MiniMaxH3在文生视频、图生视频、视频编辑三项榜单均排名前三,其中视频编辑能力排名第一。
H3在广告、品牌、电商、产品设计等商业场景中表现出色;开源特征适配合规要求高的商业化用户。H3具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2VMotionTransfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏(881275)等商业场景。模型开源后,企业可根据自身数据和业务需求进行本地部署和优化,更好地满足安全合规要求。我们认为,对合规要求较高或对数据主权敏感的商业化用户而言,本地部署意味着数据不出企业、部署与数据流完全可控,且可按自身业务微调定制,开源模型较闭源模型更适配此类需求。
视频生成价格仅为旗舰1/3,H3极具性价比。H3视频生成价格为0.8元/秒(2K分辨率),仅为业内同类旗舰视频模型的三分之一。公司通过高压缩Tokenizer降低视频生成所需的Token数量,实现了成本优化与效率的提升。针对视频长度、分辨率和多模态理解与生成负载差异较大的特点,公司在异构训练、负载均衡和GPU利用效率等方面进行系统优化,在追求模型效果的同时控制训练和推理成本。
此前头部视频模型以闭源为主,H3有望推动视频模型开源社区发展。此前SOTA视频模型以闭源为主,开源模型中的阿里万相、腾讯混元视频等模型与Seedance、可灵等闭源模型相比存在差距。视频生成领域生态开放性明显落后于大语言模型领域,相比之下,大语言模型领域在DeepSeek、Kimi、通义千问及MiniMax等开源模型的带动下,已形成“模型开放—社区共建—快速迭代”的正循环。我们认为,作为能力第一梯队的视频生成模型,H3开源后,
1)行业层面:有利于降低AI使用门槛,推动视频模型开源社区的发展并加速国产芯片适配;
2)公司层面:长期来看,模型开源能以生态优势和开发者规模助力H3迭代、能力快速提升。
开源当日多家国产芯片厂商完成全面适配。8月3日,公司宣布H3开源,多家国产芯片厂商同步公告完成适配。
1)海光信息(688041):同步实现Day0极速适配,当日完成该模型在海光DCU平台的全流程适配、部署与性能验证;
2)摩尔线程(688795):基于AI训推一体智算卡MTTS5000及MUSA软件栈,完成H3的极速适配与高效运行;
3)壁仞科技(HK6082):基于SGLang推理框架,快速完成MiniMaxH3在旗舰通用GPU产品壁砺?系列上的“Day0”适配与调优;
4)沐曦股份(688802):曦云C系列GPU亦完成Day0适配。我们认为,头部国产芯片厂商在模型开源首日集体完成适配,既验证了H3架构对国产硬件的友好度,也意味着“国产模型+国产算力”的软硬件协同生态进入实质落地阶段,有望进一步降低企业部署成本、扩大应用范围。
风险提示:技术迭代不及预期、AI商业化变现不及预期、算力不足风险等。
更多机构研报请查看研报功能>>
声明:本文引用第三方机构发布报告信息源,并不保证数据的实时性、准确性和完整性,数据仅供参考,据此交易,风险自担。
