MiniMax H3开源:视频模型迎来"DeepSeek时刻",16家芯片平台首日适配
![]()
8月3日,大模型公司MiniMax(稀宇科技,00100.HK)正式开源新一代通用视频模型MiniMax H3,在Artificial Analysis有声视频编辑榜单中位列全球第一,以1130分Elo成绩领先Gemini Omni Flash、HappyHorse-1.0、Wan 2.7等国内外头部视频模型。开源当日,华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技、AMD、Intel等国内外芯片厂商,以及Hugging Face、魔搭ModelScope、ComfyUI、RunningHub、fal等开发社区和云推理平台,共16家生态伙伴同步完成适配支持,引发业界对视频模型行业"DeepSeek时刻"到来的热议。
多模态通用视频生成能力解析
MiniMax H3是一个通用型全模态生成系统,能够统一理解由文本、图像、视频和音频构成的多模态上下文,生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。H3系统由三个核心模块组成:H3-Context-IR负责深入理解和提炼输入的多模态指令,将其转换为模型可直接理解的上下文中间表示;H3-Base负责生成768p分辨率的音视频输出;H3-Regenerate-2K则将768p结果与原始上下文结合,重新生成2K分辨率输出,实现更高视觉保真度和更精准细节还原。输入模式支持文生视频、首帧生视频、尾帧生视频、首尾帧生视频以及全模态参考模式(最多9张图像、3段视频、3段音频混合输入)。系统稳定支持11种语言生成,包括中文、英语、日语、韩语等,为全球化内容生产奠定基础。
开源生态与硬件适配规模
MiniMax H3的开源标志着视频模型赛道从"封闭旗舰"走向"开放生态"的关键转折。在首批适配方中,国内外芯片厂商覆盖了国产GPU(华为昇腾、摩尔线程、沐曦、海光信息、昆仑芯、天数智芯、壁仞科技)和主流国际芯片(AMD、Intel),推理框架包括SGLang、vLLM-Omni、diffusers和ComfyUI等主流工作流,云推理平台包括Hugging Face、魔搭ModelScope、RunningHub和fal。开发者可直接从Hugging Face下载模型权重,或调用官方API接入生产环境。这一适配规模在视频模型领域尚属首次,意味着企业用户可根据自身硬件基础设施选择最优部署方案,大幅降低使用门槛。业内分析认为,MiniMax H3的开源策略与DeepSeek开源DeepSeek-R1的模式高度相似,有望推动视频模型从闭源高价服务向开源免费部署的普惠化趋势演进。
商业应用场景与行业竞争格局
从实际测试效果来看,MiniMax H3在电影预告、游戏菜单、动态海报、时尚广告、复杂文字排版、UI动效等商业内容生产场景中表现突出。与字节跳动Seedance 2.5等同级别闭源模型在相同素材对比测试中,H3在电影预告、复杂文字和UI动效等场景中优势明显。硅谷知名风投机构a16z合伙人Justine Moore测试了行业公认难题"人物在黑板上写出Hi的画面",此前所有模型均未成功,H3首次完成该任务。从行业格局来看,过去一年视频模型能力快速提升,但真正能同时理解多种素材并在同一模型中完成生成内容并同步完成后期包装的头部产品极少。这类能力此前主要存在于Seedance 2.5等闭源模型中,用户只能通过网页或接口付费使用,无法获得模型权重进行微调和改造。MiniMax选择开源旗舰模型,希望借此推动更多硬件适配,方便企业和开发者围绕自身需求定制模型。OpenAI也于同日公布下一代模型Astra的内部突破,以2000美元算力成本破解十项数学难题,全球AI模型竞争进入新一轮加速期。
![]()
【信源】36氪 | 又一国产模型重磅开源,有声视频编辑全球第一,16家芯片及平台首日适配 | 2026-08-04
【信源】中国新闻周刊 | MiniMax开源H3,视频模型等来DeepSeek时刻了吗 | 2026-08-03
【信源】中国经营报 | MiniMax H3正式开源,视频编辑能力全球第一 | 2026-08-04
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.