最近用 Seedance 2.5 做 AI 视频,我最大的感受是:模型是真的强,但贵也是真的贵。
现在最难的已经不是“能不能生成”,而是:能不能让 AI 按我想的方式拍。
你在用AI生成视频的时候有没有遇到这些情况?
人物明明要往左跑,每次生成方向却不一样。
想让摄影机绕人物一圈,结果只绕半圈。
几个机位明明写得很清楚,AI 还是会自己重新设计。
最后只能不断:改提示词 → 重新生成 → 再抽一次。
真正烧钱的,很多时候不是第一次生成,而是:“AI 根本没理解我要怎么拍”的无效抽卡。
最近我体验了 updream 新上线的 预演台(Previs Studio),发现了一种完全不同的工作流:
与其用几百字告诉 AI 怎么拍,不如先用白模把镜头“拍一遍”,再让模型照着生成。
为了看看这套方法到底有没有用,我从简单到复杂做了 3 组测试:
第一关:控制人物路线。
第二关:控制复杂 运镜 。
第三关:控制多机位切换。
第一关: 控制人物路线
一个负伤剑客从峡谷远处跑来,需要沿三块巨石完成:中间 → 右侧 → 左侧 的 S 形闪避,最后来到前景准备反击。
提示词:
一镜到底,写实东方武侠电影质感。摄影机全程固定,不移动、不跟拍、不推拉、不摇移。第一帧, 「@人物参考图」中的负伤剑客出现,「@场景参考图」峡谷最远处的道路中央,人物仅占画面高度约 5%—8%,前景无人。剑客从远处快速朝摄影机方向奔跑,沿三块巨石之间形成明显的 S 形路线躲避箭雨:先经过远处中间巨石 → 再向右变向躲至右侧巨石 → 随后迅速向左变向躲至左侧巨石,最后冲向前景中间。箭从剑客正前方、也就是他正在奔跑和面对的方向迎面射来,箭矢不断击中道路和巨石,激起泥水与碎石。剑客每次变向都以躲避箭矢和借巨石掩护为目的,动作快速、紧张、真实。随着奔跑,人物在固定画面中逐渐完成 远景小人物 → 中景 → 前景 的明显距离变化。结尾,剑客来到前景中央急停,压低重心,右手紧握剑柄,准备反击。<箭矢破空><箭头撞击岩石><泥水飞溅><急促脚步>冷灰青色、雨后潮湿的武侠电影质感,动作真实连贯。禁止摄影机移动;禁止人物第一帧出现在中景或近景;禁止人物直接直线冲向摄影机;必须清晰完成“中间巨石 → 右侧巨石 → 左侧巨石”的 S 形躲避路线。人物和场景图:
![]()
![]()
我分别做了:纯提示词版 VS 白模参考版。
纯提示词版
白膜参考版
这一组我只看四件事:
第一次往哪边闪、在哪里变向、有没有绕过指定巨石、最后停在哪里。
纯提示词其实已经能理解“躲箭”这件事。
但问题是: 它理解的是故事,不一定能完全执行我设计好的路径。
比如这条纯提示词视频里,人物没有躲到我指定的巨石后方。
整个故事是对的,但动作细节并没有完全执行。
而加入白模之后,人物的移动方向、变向位置和最终停留区域,基本都能对应我的预演路线。
差异非常直观。
怎么做?
先在 updream 新建项目,在画布空白处右键:「新建预演台」→「打开预演台」。
![]()
![]()
![]()
进入之后,点击右上角 「生成空间」,上传场景参考图。
![]()
![]()
我这里上传了一张广角图和一张鸟瞰图。
建议优先使用:广角、全景、鸟瞰,以及纵深关系比较明显的图片。
因为这个阶段主要是为了搭建空间,而不是还原人物。
![]()
![]()
勾选插入当前预演台,选择开始生成。
勾选「插入当前预演台」,开始生成,等待几分钟就能得到一个 3D 白模场景。
![]()
基础操作其实不复杂:鼠标滚轮控制缩放,右键长按移动画面,快捷键 Q 切换导航视角。
接下来在左侧选择 「新建人物」。
![]()
选中人物后按快捷键 G,就可以直接拖动人物的位置。
![]()
我先把人物放到峡谷最远端。
然后选择:「视口逐点单击放点」开始给人物安排移动路径。
![]()
我一共放了几个关键点:远处起点 → 中间巨石 → 右侧巨石 → 左侧巨石 → 前景中央。
![]()
按下空格,就可以直接预览人物沿着这条路线移动。
这样,演员怎么走就确定了。
接下来确定观众怎么看。
人物路线确定以后,再创建机位。
因为这一条我想要的是: 固定机位,看着人物从远处一路跑到前景。
所以先把视角旋转到峡谷前方。
点击 「新建机位」→「从当前视角创建机位」
![]()
【创建机位】这时候场景里就会出现一台虚拟摄影机。
机位和人物一样,也可以选中后按 G 自由调整位置。
![]()
右上角则可以直接看到最终摄影机画面。
除此之外还可以拖拽右上角视频画面改变摄像机的拍摄角度。
![]()
按下空格,只需要盯着右上角的画面,就可以像真正拍摄一样提前看一遍效果。
![]()
确认人物路线、构图都没问题后,直接点击右上角录制。
一条白模预演视频就完成了。
只需要在原来的提示词再引用白模视频即可。
![]()
接下来只需要在原来的 Seedance 提示词前面补充一句:
「@白模视频」为粗粒度白模,仅参考人物动作路径、站位、机位、运镜及空间关系,不采用白模外观与材质。白模人物对应负伤剑客「@角色参考图」,固定几何体对应山谷巨石场景「@场景参考图」。第一关结束。
人物路线基本可以被“画出来”了。
但这还只是最简单的。
第二关: 控制复杂运镜
第二组我开始增加难度。
这次不控制人物运动,而是专门控制: 摄影机怎么动。
场景依然是武侠风。
一名剑客站在竹林破庙前。
人物基本不动。
我要摄影机做一段: 360°完整环绕 → 回到人物后方 → 后上方升高拉远 → 鸟瞰收尾。
提示词:
一镜到底,写实东方武侠电影质感。一名剑客「@角色参考图」静静站在破庙前「@场景参考图」,面向前方,衣摆和发丝被微风轻轻吹动,人物保持稳定不移动。摄影机从人物后方开始,围绕剑客进行360°完整环绕运镜,始终保持人物位于画面中心,环绕路径清晰流畅,依次经过人物后方、侧面、正面、另一侧,再回到后方。环绕完成后,摄影机不切镜,立刻向后上方快速拉远并升高,从中景过渡到大全景,最后形成高空鸟瞰视角,同时看到剑客、破庙、竹林小路和周围环境,完成收尾。写实武侠电影质感,运镜流畅稳定,空间过渡清晰,禁止切镜、禁止跳位、禁止瞬移、禁止突然变焦。主角和上个案例一样,场景图如下:
![]()
还是一样:纯提示词 VS 白模参考。
纯提示词
纯提示词其实也能生成一条非常有电影感的视频。
但仔细看,很容易发现问题。
我要求的是: 完整绕人物一圈。
实际只绕了半圈左右。
更明显的是,拉远之前破庙明明位于人物前方,到了后面的大全景,建筑和人物之间的空间位置却发生了变化。
单独看可能还挺漂亮。
但如果这是电影里的一个连续镜头: 这种空间跳变显然经不起推敲。
再来看白模参考版本。
这一版不只是环绕方向和运动节奏更符合预期,人物、破庙和竹林之间的空间位置关系也稳定得多。
怎么做?
这一组场景生成、人物创建和位置调整,和第一组基本一样,我就不重复了。
不同的是: 人物不需要移动,真正要动的是摄影机。
先给人物添加一个自然站立状态。
然后创建机位。
![]()
![]()
然后点击绘制轨迹。
![]()
接下来是重点。
接下来添加机位轨道,并关联人物。
![]()
新增机位轨道,关联人物
![]()
在右侧选择: 环绕运镜 → 转为路径片段
![]()
这样你就可以直接看到摄影机围绕人物运动的实际路径。
需要完整一圈,就让它完整一圈。
需要最后往后上方升高,就直接把路径调整到对应位置。
也就是说:以前提示词里那句“360°环绕人物”,最终怎么绕还是 AI 自己理解。
现在变成: 摄影机真的先在 3D 空间里绕一遍。
调整完成后,同样导出白模视频。
![]()
最后引用白模视频作为参考视频,前面提示词加上:
「@白模视频」为粗粒度白模,仅参考人物动作路径、站位、机位、运镜及空间关系,不采用白模外观与材质。白模人物对应负伤剑客「@角色参考图」,场景「场景参考图」。这一次测试的是: 摄影机怎么走。
接下来继续加难度。
第三关: 控制多机位切换
前两组分别测试了: 演员怎么走。摄影机怎么动。
第三组,我想测试一个非常常见、但也特别容易失控的问题: 多机位切换。
场景依然沿用竹林破庙。
人物还是同一个剑客。
这一次连剧情都几乎没有。
剑客只是站在破庙前保持警戒。
我要做的是: 5 秒视频,5 个不同的静态机位,每秒切一次。
这个测试看起来很简单,其实对纯提示词的控制能力要求非常高。
因为模型必须同时理解: 机位数量、景别、方向、切换顺序和切换时间。
提示词:
写实东方武侠电影质感。一名「@主角参考图」剑客独自站在破庙前「场景参考图」,衣摆和发丝被微风轻轻吹动,周围竹林安静压抑。全片共5个静态镜头,每1秒切换一次机位,每个镜头都固定不动,不推拉、不摇移、不跟拍。镜头1(0–1秒)正面全景完整展示剑客、破庙、竹林和前方小路,建立整体环境。镜头2(1–2秒)侧后方中景剑客微微侧身,右手靠近剑柄,表现警觉状态。镜头3(2–3秒)正面近景聚焦剑客上半身和面部,突出冷峻表情与紧张气氛。镜头4(3–4秒)侧面全景展示剑客与破庙、竹林的空间关系,人物静止站立,衣摆轻动。镜头5(4–5秒)高位俯拍大全景从上方看到剑客、破庙、小路和周围整片竹林,完成收尾。重点:5个固定机位,1秒一切,切镜清晰明确,顺序固定。写实武侠电影质感,冷青灰色调,雨后潮湿空气,气氛安静压抑。禁止运镜,禁止慢动作,禁止额外切镜,禁止镜头停留时发生机位移动。但我提前设计好了 5 个完全不同的视角。纯提示词版本:
这一次,纯提示词还是完成了大部分要求。
但看第 4 秒就错的很明显:我要求的是 侧面全景。
结果模型生成的还是一个偏正面的全景,只是人物侧了一点身。
也就是说: 它理解了“换一个镜头”,却没有真正执行“换到场景侧面”这个空间要求。
白模型视频。
再看白模参考后成片版本。
这一次,5 个镜头的位置、方向和顺序都更接近我最初设计的结果。
尤其是这种: 正面 → 侧后方 → 正面近景 → 侧面 → 高位俯拍
差异非常容易一眼看出来。
怎么做?
我没有重新做场景。
直接沿用前面的竹林破庙。
接下来只做一件事: 创建 5 个机位。
按照刚才的方法,分别调整到:
机位1:正面全景。
机位2:侧后方中景。
机位3:正面近景。
机位4:侧面全景。
机位5:高位鸟瞰。
![]()
然后在时间轴里按顺序排列:
机位1 → 机位2 → 机位3 → 机位4 → 机位5
每一个持续 1 秒。
这就是我觉得预演台越来越像虚拟片场的地方。
你可以直接决定: 第一台摄影机放在哪里。第二台是什么角度。这一台拍多久。下一秒切哪一台。
镜头语言真正开始从“描述”变成“设计”。
最后
三组测试分别对应:
第一组:控制人物路线 第二组:控制复杂运镜 第三组:控制多机位切换
难度越高,纯提示词越容易出现偏差,白模的价值也越明显。
现在我判断一个镜头要不要做预演,只看一点:
生成之前,我是不是已经很清楚它该怎么拍?
如果只是人物特写、产品展示、氛围空镜,直接让 AI 发挥更快。
但如果人物路线、摄影机运动、机位顺序都有明确要求,我会优先用白模。
一句话: 让 AI 发挥,用提示词。让 AI 执行,用白模。
当然,预演台也不是用了就能 100% 一次成功。
人物细节、动作和物理效果依然会有随机性,而且前期也需要花一点时间熟悉人物、机位、轨迹和关键帧。
但它的价值就在于: 前面多花一点“设计时间”,后面少花一点“抽卡成本”。
以前只能跟 AI 说: “我想这么拍。”
现在可以先把人物、场景、摄影机都排好,再告诉模型: “就按这个拍。”
所以我更愿意把 updream 预演台理解成一个 AI 视频创作者的轻量虚拟片场 。
目前 updream 也上线了 「千万积分预演台挑战赛」 。
如果你经常遇到人物跑错方向、运镜不完整、切镜不准确,不妨先在预演台里排一遍,再交给模型生成。
这也是我觉得 AI 视频开始需要“预演”的原因。
感谢你读完。
记得星标我 ⭐,后续继续分享更多 AI 产品实践、工具探索和创业思考。
很高兴与你相遇,我们下期见。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.