三镜头,同一场戏,AI把太阳换了三次。广角镜头里,金色的长光斜穿过树林;插入镜头里,是正午的平光;切到人物特写,光线又接近黄昏。三个镜头,来自剧本里同一行字:EXT. FOREST - DAY。
模型没有搞混。搞混的是提示词。剧本里的场景标题,本身已经包含了AI视频提示词最需要的东西——地点和时间的锚点。但标准格式是故意写得模糊的,直接把它复制进提示词,正是你那些AI生成的镜头总是对不上时间的原因。这不是模型的问题,是翻译的问题,而且在你花掉第一次生成额度之前就能修好。
![]()
什么是场景标题,AI模型为什么在意它
场景标题,也叫slugline,是剧本里每个新场景开头那行全大写的字:INT. 或 EXT. 表示室内或室外,一个地点名,一个时间,中间用破折号隔开。EXT. FOREST - DAY。INT. KITCHEN - NIGHT。
从打字机时代到现在,它一直长这样。从Final Draft到Scrivener再到Celtx,所有编剧工具都还是这么排的。
对一个真人剧组来说,这已经够了。灯光师读到“DAY”,会去看通告单、看景照片和天气预报,然后决定实际的布光方案。美术指导读到“FOREST”,脑子里已经钉着一板参考图了。场景标题是一个指针,指向的信息存在别人的脑子里。
AI视频模型没有别人的脑子可以调取。每一次生成,只能从提示词里的那些词得到答案,别的什么都没有。当提示词只有场景标题时,模型只能从零开始编出缺失的那90%,而且每一次编得都不一样。
为什么标准格式对AI提示词是错的
因为它刻意模糊,而这种模糊对剧组是优点,对生成模型是缺陷。
编剧格式指南把这一点说得很明白:标准的时间选项只有DAY、NIGHT、SAME或LATER,而且明确要求编剧不要在标题里写精确时间。这是正确的技艺。剧本是蓝图,不是布光提示单,好编剧会给摄影指导留出当天做决定的空间。
场景标题被造出来,就是为了让人类去补那个空。AI模型补不了它看不见的空。它只能随便挑一个,而且你每问一次,它挑的都不一样。
地点也是一样。“FOREST”是一个标签,人类美术指导会把它展开成几百个具体选择:什么树、多密、地上有什么、树冠间透出多少天空。把“FOREST”喂给模型六次,跨同一场戏的六个镜头,你会得到六片不同的森林,因为提示词里没有任何东西告诉它复用第一片。
怎么把场景标题变成AI视频提示词的锚点
在开始生成之前,先把它展开一次,然后把这个展开结果复用到整场戏的每一个镜头里。展开的动作只需要做一次,收益却覆盖整场戏。
展开的方向,就是场景标题原本省略掉的那些项。时间上,把DAY换成具体的光线描述;地点上,把FOREST换成具体的树种、密度、地面和天空占比。这些信息原本存在于剧组的其他文档和别人的脑子里,现在需要被写进提示词本身。
关键在于“一次展开、多次复用”。同一场戏的六个镜头,如果共用同一段展开后的环境描述,模型就没有空间去发明第六片森林。它拿到的锚点是同一个,输出的光线和场景才有机会保持一致。
所以问题从来不在模型身上。它只是忠实地回答了提示词里写着的那些字。剧本那行字是写给人类读的,人类会自己补全;模型不会。把该补的补上,太阳就不会在同一场戏里换三次。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.