国产大模型公司MiniMax于7月31日发布新一代多模态生成模型 MiniMax H3,并宣布近期开源。
据介绍,MiniMax H3支持文本、图片、音频和视频等多种输入形式,支持2K分辨率直出,可生成最长15秒的音画内容,在提升视听生成能力的同时,进一步降低高质量视频内容的创作和使用门槛。
自成立以来,MiniMax坚持文本与多模态模型并行自研,已先后开源三代M系列文本模型。H3则是MiniMax推出的首款开源多模态生成模型。针对视频长度、分辨率和多模态理解与生成负载差异较大的特点,MiniMax 在异构训练、负载均衡和GPU 利用效率等方面进行系统优化,在追求模型效果的同时控制训练和推理成本。
“通过MiniMax H3,我们希望为更多企业和开发者、创作者降低内容创作的门槛。H3将于未来几天内开源,企业可以在本地灵活部署,结合自身数据和业务进行优化,更好地满足安全合规要求;芯片厂商和开发者也能共同参与适配和优化,降低使用成本,扩大应用范围。”MiniMax相关负责人表示,“我们会持续推动优秀的文本、多模态模型从过往的封闭服务,走向更加开放、可协作的产业生态。”
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.