北京商报讯(记者 魏蔚)7月31日,MiniMax 发布新一代多模态生成模型 MiniMax H3,并宣布近期开源。作为 MiniMax 从"特化任务模型"迈向"通用多模态智能"的重要探索,H3 不再以图片、视频、声音的生成、编辑和参考等单一任务为边界,而是在多模态上下文中统一理解创作意图,完成更加自然、连贯的生成与表达。
MiniMax H3 支持文本、图片、音频和视频等多种输入形式,支持 2K 分辨率直出,可生成最长 15 秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。
在模型效果方面,MiniMax H3 具备商用级的多场景内容生成能力,在指令遵循、文字与品牌信息呈现、V2V Motion Transfer(视频到视频动作迁移)等方面表现出色,可实现精准、可控的多模态内容编辑与生成,并广泛适用于广告、品牌、电商、产品设计、UI/UX、游戏等商业场景。在 Artificial Analysis 视频模型榜单中,MiniMax H3 在视频编辑能力项排名全球第一。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.