做 AI 视频有一年多,从最开始随便丢一句文字就让 Seedance 生成,到现在能稳定产出连贯、人物不崩、运镜丝滑的短片,踩过的坑实在太多。
后台每天都能收到朋友发来的截图吐槽:明明写满 “电影感、高级光影、真实质感”,生成出来的画面要么人物中途换脸,要么动作卡顿,镜头乱晃,剧情完全和自己预想的不一样。
![]()
之前我也一直纳闷,同样是 Seedance 2.0,别人能产出完整短剧片段,我只能拿到一堆零碎、逻辑混乱的画面。直到反复测试、对照官方多模态逻辑才想明白:我们从一开始就搞错了提示词的定位。
真正能稳定出片的 Seedance 提示词,本质是一份给 AI 执行导演的拍摄清单,必须说清 8 件核心事:画面主体是谁、完整动作流程、场景环境、光影来源、镜头运镜方式、统一视觉风格、画质标准,还有绝对不能改动、禁止出现的约束条件。
01
先分清三类任务,提示词写法完全不一样
Seedance 2.0 支持图片、视频、音频多模态联动,不同创作目标,指令措辞不能混用,这是绝大多数新手忽略的关键点。
多模态参考生成适合复用人物长相、模仿动作、照搬运镜、借鉴画面风格,核心逻辑是 “提取素材某一特征,生成全新视频”。
举个反面例子:只写 “参考图 1 生成古风视频”,AI 不知道你要参考人物、服装还是场景,结果大概率跑偏。
正确写法:参考图片 1 里黑金劲装、低束马尾、眉带旧疤的女子作为固定女主,参考样片缓慢拔剑的动作节奏,生成雨夜宫门前对峙片段。
2.编辑已有视频在原有视频基础上修改、增删元素,重点一定要写明 “哪些内容保持不变”。
替换服装、删掉路人、增加特效、修改天气都属于这类。这里有个关键细节:指代原视频直接写 “视频 1”,不要用 “参考视频 1”,后者会被模型判定为提取素材,而非修改画面。
实操示范:严格编辑视频 1,将女主黑金劲装替换为红色长裙,人物五官、原有动作、场景、镜头全部保持原样,不得改动。
3.延长现有视频沿着原视频剧情前后续写,补全未完成的动作、对话,要求全程统一画风、人物、光影。
示例:向后延长视频 1,女主拔剑后没有进攻,缓慢抬剑指向宫门,远处鼓声渐起,人物造型、场景色调、运镜逻辑全程不变。
三类任务还能自由组合,比如 “参考图片人物造型,编辑现有视频更换服装”,核心句式固定:参考素材指定维度 + 编辑原视频 + 明确修改内容 + 不变内容约束。
02
万能提示词骨架,8 个模块缺一不可
我整理了一套长期实操验证有效的结构化模板,不管是古风短片、现代剧情、产品短视频都能用,不用堆砌华丽辞藻,把信息填完整,成片稳定性直接翻倍。
1. 精准锁定主体(重中之重,解决变脸、人物错乱)
不要模糊写 “一个女生”,尽可能标注外貌、穿搭、年龄,多张图统一人物可以提前命名,全程复用。
差:一个站在城墙的古风女生
![]()
好:定义图片 1 中低马尾、黑金劲装、左眉带疤的女子为女主,全程保持面部五官不变
![]()
2. 拆解可见动作,拒绝抽象情绪
AI 只能识别具象动作,“难过、压抑、紧张” 这类词汇很难落地,要用肢体细节表达情绪。
差:女生看着照片很悲伤
![]()
好:女生走到桌前停下,指尖轻轻触碰旧照片边缘,肩膀收紧,眼眶泛红,没有落泪
![]()
3. 细化场景空间,固定画面构图
简单一句 “房间里” 会让 AI 每次生成不同布局,把门窗、家具、物件位置写清楚,镜头背景不会乱变。
![]()
4. 写明光影来源,画面情绪靠光线支撑
别只写 “高级光影”,标注光源方向、冷暖色调、明暗对比,氛围感自然到位。
示例:傍晚冷灰色天光从左后方窗户照入,桌面暖台灯形成冷暖对冲,人物半张脸落在阴影里。
![]()
5. 单次只定一种运镜,镜头不混乱
切忌同时堆推拉摇移环绕,一个镜头只安排单一运镜:固定中景、缓慢向前推、平稳横移、低机位仰拍,多运镜拆分多条生成。
6. 统一视觉风格,杜绝多种画风冲突
写实电影、日系胶片、3D 国风、赛博朋克不能同时堆砌,选定一种风格贯穿全程。
7. 画质作为补充,不用过度堆砌 8K、超清
画质词只是加分项,只靠高清关键词解决不了动作、人物崩坏问题,简单标注细节丰富、动作流畅即可。
8. 硬性约束条件,规避 90% 翻车问题
结尾统一加上限制:人物面部稳定、无穿模、无闪烁卡顿、无水印 Logo、无字幕文字,把 AI 容易出错的点全部提前锁住。
03
音画台词分开标注,AI 不会混淆指令
很多人把画面、背景音乐、音效、台词全部揉在一段话里,模型容易读取混乱,我平时会用固定符号区分,生成音画同步更稳定:
背景音乐用圆括号():(低沉古琴搭配缓慢鼓点)
环境音效用尖括号 <>:< 远处宫门关闭的厚重声响>
人物台词用大括号 {}:女主低声开口 {我等这一天,整整十年}
章节字幕用【】,不需要字幕就直接写:全程无任何字幕、文字
完整示范片段:
女主立于雨夜宫门,右手缓缓握紧剑柄。(低沉古琴声慢慢响起) <远处铁甲摩擦、鼓声阵阵传来> 女主抬眼望向宫门,低声说 {我等这一天,整整十年},全程无字幕水印。
04
同一段剧情,两种提示词差距一目了然
拿乡村怀旧短片举例子,直观感受模糊文案和导演式指令的区别。
1.普通模糊写法(极易翻车)
女孩回到老家老屋,看见旧照片心里难过,电影质感,光影高级真实。
问题:女孩身份、房间布局、动作流程、镜头、光线全部空白,AI 全靠猜测,每次成片完全不一样。
2.结构化完整写法(稳定出片)
蓝白校服、旧书包、黑马尾 18 岁女生定为林夏;场景是乡村老屋卧室,木门在画面右侧,左后方开窗,窗边木桌摆放暖光台灯与旧照片。林夏从右侧木门缓步走入,把书包放在桌边,低头看见照片,指尖轻触相片,肩膀紧绷,眼眶泛红。侧面中景固定机位,随后缓慢推近人物面部;窗外冷调傍晚天光和台灯暖光形成对比,背景轻微虚化。真实年代乡村电影质感,色彩低饱和,人物五官稳定、动作连贯,无水印无字幕。
(背景轻柔低沉钢琴) <窗外风声、老旧木门吱呀响动>
没有任何花哨修饰词,只是把拍摄需要的全部信息交代完整,AI 不用自行脑补,成片几乎不会出现崩坏问题。
05
最后想说
做 Seedance 这么久,最大的感悟就是:写提示词从来不是比拼文字华丽度,更不是写文学作文。
你不是在向 AI 描述一段幻想画面,而是像片场导演一样,下达清晰、完整、有边界的拍摄执行指令。
今天的分享就到这里啦,觉得我的文章有用,记得一键三连,点个关注、分享、喜欢。持续分享更多 AI 内容创作干货技巧~
看到这里的宝子有福啦!
从零开始,一起领略AI创作的魅力!
↓↓0元 扫码领取↓↓
《预约今晚的AI课程》
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.