![]()
当一个视频模型和 Seedance 2.5 同一天发布,似乎大概率要成炮灰,但 MiniMax H3 却成了一个例外。
MiniMax H3 在八月初正式开源之后,国内外的社交媒体上网友都玩疯了。其中最受关注的莫过于「中国仙境」系列,用 Midjourney 生成高质量的参考图,放到 MiniMax H3 中进行创作,震撼了大量网友。
![]()
高级的视觉审美、丝滑的动态效果以及连贯的角色一致性,都是网友们对 MiniMax H3 生成视频的评价。APPSO 当时也第一时间实测了 MiniMax H3 的视频表现,用来制作各式各样的品牌视频、特效视频,几乎都是一次性就可交付。
而现在 MiniMax 也开始把这种模型的能力,放到了具体的产品上,正式推出了 MiniMax Design,进一步把 H3 视频模型的能力放大,同时也让我们少折腾一些,可以更高效地制作各种商业化内容。
![]()
就像 GPT-5.6 Sol + Codex、DeepSeek V4 + DeepSeek Harness 才能发挥出模型真正的 Agent 能力,MiniMax Design 正在做的,也是把 H3 的生成能力,接入一套能够持续修改、协作和交付的完整工作流。
第一眼看到 MiniMax Design 的页面会觉得太「专业」了,ComfyUI 那套工作流和完整画布,在这里是基础的功能,但实际体验一段时间后,会发现 MiniMax Design 的 Agent 团队能解决大多数的问题。
![]()
不会使用画布,不理解 3D 导演台里的机位和动作调度,也不知道如何连接 ComfyUI 工作流,都没有关系。
我们只需要说清自己想做什么,MiniMax Design 会自动帮我们完成全部的制作,应用内大量的 Skills、模型、Agents 等能力会主动理解并拆解我们的需求,一步一步自动执行。
这也是 MiniMax Design 的核心作用:把这些专业能力组织成可执行的节点,再调动 H3、生图、音乐和语音模型完成后续制作,把 AI 视频创作这件事推向了真正的完整生产。
![]()
如果你不会写 AI 视频的提示词,每次都是从 ChatGPT 复制到海螺视频生成,或其他 AI 视频的网页,然后等它生成。
这次不妨替换到 MiniMax Design,不需要提示词,只是简单的需求,然后看着它自己创建画布、生成提示词、分镜板、图片、配乐、台词对话、剪辑、字幕、视频……
重拍《牛来》的一场戏
《牛来》这部从画面到台词,都集抽象文化于一体的电影已经成了一种文化现象。一些用视频模型「复刻」的同款《牛来》,甚至比电影原版还要更精致,网友们表示根本没有原片的味道。
我们也用 MiniMax Design 做了个片段复刻,输入提示词「帮我在导演台搭一场戏:男主和女主在草原上走,面前遇到一条很宽的河,女主纵身一跃跳过河对岸,男主在河这边来回踱步。」
![]()
生成这个视频对 MiniMax Design 来说其实挺复杂的,但是我们的操作就只有上传素材和对话。
点开 MiniMax Design 的页面,和大多数视频生成的首页类似,中间是一个对话框,我们输入需求,添加素材,选择项目、模型、Skills 等自定义选项。左侧边栏则是完整 Skill、ComfyUI 工作流、项目库和资产中心的入口,以及处理的项目列表。
输入需求之后,MiniMax Design 会自动打开一个画布,所有的素材、工作流都将在这块画布上呈现。
![]()
一般来说,MiniMax Design 会自动生成完整的 Markdown 格式 Brief 文档,或者提示词文档,以及使用生图模型生成可能用到的静态帧图片,接着它会结合文本文档、静帧图片,使用 MiniMax H3 生成视频。
![]()
在《牛来》这个案例中,我们使用了「3D 导演台」的功能,点击画布正下方的「+」,可以添加文本、表格、图片、视频、音频,以及 3D 导演台、视频剪辑和 ComfyUI 工作流几类节点。
选择「3D 导演台」之后,我们就会进入一个导演台 Agent。同样的,点击画布上的提示词文档,我们也能得到一个文本助理 Agent,帮助我们调整文本;点击图片或视频,也会自动展开图片/视频的生成对话框,可以调整提示词,选择模型、尺寸等内容。
![]()
在「3D 导演台」内,用户或 Agent 可以在 3D 场景中直接摆放角色素体、调度机位与姿态,快速搭建分镜参考,使画面的可控度能得到明显提升,抽卡和试错成本也能大幅降低。
![]()
这些复杂的导演台内容,又是要调整动作,调整角色,看起来就很复杂,但其实整个 3D 导演台都是由 MiniMax Design 自动帮我们搭建的,我们做的只是在侧边栏的导演台 Agent 给它下达各种需求。
这场戏的难点来自人物之间的空间关系:女主需要跃过河流,男主则要留在对岸来回踱步,同时还要保证动作方向和镜头调度前后一致。单靠一段文字直接生成,人物位置和运动轨迹很容易发生偏移。
最后它会先给我们一个导演台的运镜视频,MiniMax Design 再参考视频中的运镜,帮我们精准生成最后的视频。
![]()
3D 导演台的价值在于把模糊的自然语言要求,转换成明确的空间和运动参考。动作不对时,我们可以先在导演台里调整角色和机位,再重新生成对应镜头,减少围绕最终成片反复抽卡的次数。
能处理这类复杂的 3D 导演台,MiniMax Design 制作各种特效视频也是完全不在话下。
像是制作一个悬疑电影的片头,我们使用 MiniMax Design 内自带的 Skill,然后输入提示词要求它做一个中文电影,中文角色。它会自动生成多个关键帧的生图 Prompt,调用 GPT-Image-2 等生图模型,先生成分镜图。
![]()
最后的效果确实超出我的预期,这些复杂的特效和动画,如果要用 Adobe PR 或 AE 等软件去手搓,难度相当大。
如果一个 15s 的片头还不够考验 MiniMax Design 的能力,我们直接要它做了一个 1 分钟的 MV,从歌词、编曲到最后的成片,完全是由 MiniMax Design 一手操办。
![]()
我们只需要在侧边栏的 Agent 里对话,MiniMax Design 就会自动在画布上完成所有的工作:从歌词与编曲、视觉风格设定、分镜规划、关键帧生成、H3 视频生成,到最后的配乐、字幕和剪辑。
由于 H3 单次最多生成 15 秒视频,一分钟 MV 还需要被拆成多个镜头,再重新组织成一条风格和节奏相对连贯的时间线。
![]()
这里我们可以看到它对长视频的编排能力,H3 负责逐个生成镜头,Agent 负责拆分任务、统一风格,并把多个片段重新组织成一条完整时间线。模型的单点能力,在 MiniMax Design 内被扩展成了多模型协同的制作流程。
MiniMax Design 内置的 Skill 库中,还有大量预设的案例。我们可以直接与 Agent 对话,套用同样的风格,快速生成类似的视频。
像这个纸拼贴视频,整个的工作流程,我发送的提示词只有「我想用纸拼贴做一个故事剧情片,大致的情节是……」
![]()
一样是等着 MiniMax Design 自动完成所有的工作,我们就得到了这段 42s 的伤感故事。
把一套模板,变成一条视频生产线
纸拼贴案例更有价值的地方,在于这套工作流可以继续复用。第一支剧情短片确定了纸张质感、角色样式、转场方式和叙事节奏之后,同一个 Skill 还可以被套用到新的主题中。
我们直接利用那套纸拼贴模板,再做了一个科普日全食的版本。全程我们只是输入了一下提示词,「能不能用这种纸拼贴来解释一下什么是日全食」、「我觉得视频可能要 20s 左右比较好」、「要加 BGM、旁白和字幕」。
![]()
保留了原有的视觉包装,只调整内容主题、视频长度、旁白和字幕要求。原本的一支风格样片,因此变成了一套可以持续生产不同选题的频道模板。
![]()
成片之后,Agent 还将项目继续扩展成无字幕版、儿童旁白版和庄重科普版等分支。同一套素材和工作流,可以由此快速派生出面向不同平台与受众的版本。
如果需要其他的模板,MiniMax Design 也能生成类似轻科普的动漫短片,来解释为什么一帧一帧的图片放在一起就能变成视频。
![]()
以往制作这类动画,需要大量人工编辑,先是要画多个复杂的矢量图标,然后丢到动画渲染软件中,一步一步生成。而现在,MiniMax Design 几乎是把这种类型做成了批量式生成。
这类科普还能用在教育场景,例如我们只是上传一份课程 PPT,MiniMax Design 就能创作出对应的水墨画视频。
![]()
上传一首诗,它也会继续扩展其中的意象和叙事线索,最终组织成一部三分钟纪录片。
![]()
在电商场景,MiniMax Design 的作用更多体现在素材编排上。不同角度的产品图片会作为独立节点保留在画布中,再分别连接到关键帧生成、视频生成和剪辑等环节。
相比在多个网页之间反复下载、命名和上传素材,画布能够保留每张产品图与对应镜头之间的关系。需要修改时,我们可以直接回到相关素材或镜头节点,后续扩展不同卖点、尺寸和平台版本也会更加清晰。
![]()
例如这些复杂的工作流,由不同的产品图片,生成视频的不同静态帧,全部是由 MiniMax Design 帮我们连起来的。
![]()
甚至,上传一个 APPSO 的 logo,MiniMax Design 就能给一个酷炫的动态效果。
![]()
一份已有的品牌资产可以继续接入新的生成流程,扩展成视频片头、动态标识或其他包装素材。
应用 AI 化,模型应用化
相比此前我们单独测试 MiniMax H3,MiniMax Design 在完整创作流程和最终视频生成效果上的表现,给我们留下了更深的印象。
单一的对话式生成,似乎很多时候依赖我们自己的创意和想法,视频中出现的什么内容,都需要靠提示词在一开始指定,或者上传参考文件。
MiniMax Design 带来的变化是,输入提示词之后,这个项目才刚刚开始。我可以继续在画布上调整生视频用的参考图片,可以继续要求 Agent 调整提示词,甚至可以添加导演台这类专业化工具,让视频生成更可控,可交付。
![]()
这些变化,让我们想到过去几年创作软件的主旋律都是「应用 AI 化」:在原有工作流里加入生成图片、智能抠图、文本成片等功能。MiniMax Design 似乎展示了另一种同时发生的趋势——「模型应用化」。
当 MiniMax Design 能围绕视频模型搭建画布、资产中心、3D 导演台、Skills 和 Agent,模型输出的单位也从一段素材,逐渐变成了一个可以继续编辑、修改和交付的完整项目。
![]()
▲MiniMax Design的视频剪辑Agent助理
过去的创作软件围绕工具组织界面,模型原生的创作软件则开始围绕创作意图组织工作流。用户可以直接描述自己要做什么,再由 Agent 决定需要哪些模型、素材和步骤。
MiniMax Design 把工作拆给一组 Agent,由它们理解 Brief、规划流程、调用模型,再把脚本、分镜、画面、配音、配乐、字幕与剪辑汇总到同一块画布上。
复杂度依然存在,只是其中很大一部分被 Agent 接管了。我们可以从一句自然语言开始,专业用户也能进入导演台、ComfyUI 工作流或任意素材节点继续干预。自然语言降低了创作的起点,画布和工作流则保住了专业生产所需要的控制力。
![]()
沿着这条路径,MiniMax Design 开始触碰到专业创作软件真正关心的部分:稳定、可控、可修改和可复用。
现阶段,帧级精修、复杂合成以及严格的品牌资产管理,依然需要 Adobe PR、AE 和成熟制作团队完成。但从概念、脚本、分镜到素材生成、粗剪和版本扩展,MiniMax Design 已经可以接管相当长的一段流程。
这也意味着,MiniMax H3 + Design 已经切入 Adobe 长期占据的专业创作工作流,开始替代其中最标准化、最高频的一部分。过去主要为 PR、AE 提供素材的视频模型,如今也开始争夺完整项目的制作入口。
尤其是对于科普视频、电商素材、品牌短片等需要高频交付的内容,这段流程往往恰好最耗时间。
当模型让创作软件的上限不断抬高,软件又把模型抽卡的惊艳,变成可以重复的交付时,MiniMax Design 走在了下一代专业创作总控台的路上。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.