【导语】
AI 成片工作台「立刻成片」今日正式上线。这是继「立刻 MV」「立刻修相片」之后,立刻 AI 视频家族的第三款产品。与市面上其他 AI 成片类产品最大的不同在于,立刻成片采用"先生成声音、后生成视频"的技术路径——以极低的成本快速预览成片全貌,再用音频锁定全片结构,让视频生成的节奏更可控、成功率更高。剧本、配音、分镜、画面、字幕、配乐,一站全包:一句话创意进去,一条能发的视频出来。
![]()
先声后画:把不确定性从贵的环节挪到便宜的环节
市面上的 AI 成片产品,普遍的做法是先生成画面,再配上声音。立刻成片把这个顺序反了过来。
这个反常规的选择,来自创始人雷涛的一个观察。"AI 成片最大的用户痛点是不确定性。你花了时间和点数,生成出来的东西和你想的不一样,改也没法改,只能重来。"雷涛拥有二十余年视频产品经验,曾任一下科技高级副总裁,是小咖秀的创始人,主导了秒拍、一直播等亿级用户产品的开发运营。"我们复盘了大量失败案例,发现问题的根源在于——大多数产品让视频生成承担了太多职责,画面既要好看,又要扛起叙事结构,模型顾此失彼。"
先声后画,正是对这个问题的回答。
第一,预览成本大幅降低。声音的生成成本远低于视频——在消耗大量视频生成资源之前,用户就能通过完整的配音、配乐和剧本结构,听到并感知整条片子的全貌。节奏对不对、内容顺不顺、情绪走向合不合预期,在这个阶段就能判断和调整。
第二,音频锁住了全片结构。"声音便宜、快、稳定,而且天然携带结构信息——一段配音的时长、停顿、情绪起伏,就是这条片子的骨架。"雷涛说,"先把骨架立起来,让用户确认方向,再让视频模型在确定的框架里专心把画面做好。这不是技术炫技,是把不确定性从贵的环节挪到了便宜的环节。"
声音先行确定后,每一个镜头的时长、节奏、情绪锚点都有了明确依据,视频生成不再是开盲盒式的自由发挥。行业里俗称的"抽卡",成功概率因此显著提高。即便某一镜不理想,也只需单独重做那一镜,不用整片重来;生成失败会明确告知原因,且不扣费。
用一句话概括:别人是画面拼出一条片子,立刻成片是声音撑起一条片子。
![]()
技术底座:豆包音频模型的首个成熟视频应用
"先声后画"这条路径能够成立,背后是音频生成技术的一次代际跨越。
今年6月,字节跳动在火山引擎 FORCE 原动力大会上发布豆包音频生成模型 Seed-Audio 1.0。与传统的语音合成(TTS)不同,该模型将人声、配乐、音效、环境声视为同一个声音场景,在一次生成中同步编排角色对白、情绪语气、背景音乐及拟音特效,直出影视级的完整音轨。
立刻成片是 Seed-Audio 1.0 发布以来,第一款正式上线的成熟视频应用。立刻成片的声音设计能力——配乐、环境声、音效按剧本情节锚点编排,雨声渐起、场景过渡都跟着故事走,人声与配乐分层混音、全片响度统一——正是建立在这一新型音频生成架构之上。
在视频生成侧,立刻成片与「立刻 MV」共享同一套模型接入体系。立刻 MV 此前已全面接入包括 Seedance 2.5 在内的顶级视频大模型——支持单次30秒长叙事生成、最多50份全模态参考素材输入及时间戳级精准编辑。立刻家族在大语言模型、图片生成、音乐生成、音频生成、视频生成每一个能力维度上,都坚持接入当下最顶级的模型。
音频模型定结构,视频模型出画面,两条最前沿的模型能力线,在立刻成片的工作流里第一次真正咬合在了一起。
![]()
不需要会写 prompt:只把简单留给用户
模型能力顶级,使用门槛却低到不能再低——这是立刻家族三款产品共同的基因,立刻成片延续了这一点。
"现在 AI 成片赛道很热闹,但我观察到一个普遍问题。"雷涛说,"大家都在卷模型能力的堆叠,产品做出来却越来越像专业工具——要懂参数,要会写 prompt,要理解模型的脾气。这等于把使用门槛又立回去了。AI 本来是来消灭门槛的,结果变成了一个新门槛,这件事本身就很荒诞。"
"我们的答案是反过来:让用户不需要任何视频制作和大模型的专业技能,不用会写 prompt,只需要专注于创意和想法本身。你有一句话的想法,就够了,剩下的复杂度全部由产品来消化。这不是降低标准,恰恰是最高的标准。"
具体到产品上,立刻成片支持三种创作起点:给一句创意、粘贴一篇现成文案、或直接上传一段音频——从用户手里已有的东西出发,不强迫任何人从零开始。成片时长支持15秒到3分钟,也可以完全交给内容自动决定。
AI 编剧自动写出带场次结构的完整剧本,旁白、角色、对白分配清晰,广告、故事、观点口播各有各的写法;每一步都能修改,改几个字不用推倒重来。对白镜头里的角色口型与台词逐字对应,多角色自动选角配音。人物、物品、场景走参考图体系,多镜头之间形象统一,还支持上传实拍照片作为参考——文旅、品牌拍摄的真实素材可以直接进片。字幕按真实语音识别的时间轴逐句切换,视频镜头出一段就能预览一段,预览听到的就是成片会有的。
系统甚至会对说话内容自动复核——念错专名、丢句,能自己发现并标出,让用户单独重做那一镜。计费透明:剧本生成免费,按秒计费的只有视频生成环节,重新合成永远免费。
![]()
瞄准短剧之外的蓝海
立刻成片上线的时间点,正值 AI 视频应用扎堆短剧的行业热潮。但立刻成片选了一条不同的路。
"现在短剧很热,几乎所有视频应用开发者都在往短剧扎堆。但我不这么看。"雷涛表示,"视频作为一种媒介,应用范围远比短剧宽广。宣传、科普、教育、情感分享、观点表达,每一个方向都是真实的、大量的、日常的需求。而且这些需求的主人,恰恰是最没有视频制作能力的人:文旅局的宣传干事、想讲清楚一个知识点的老师、有观点想表达的普通人。短剧是一条拥挤的赛道,而这些,是一整片没人认真服务的蓝海。立刻成片瞄准的就是这里。"
"做了二十年产品,我始终相信一件事。"雷涛说,"用户不会因为你的模型强而留下来,会因为在你这里,他的想法能最简单地变成作品而留下来。"
关于立刻 AI 视频家族
立刻 AI 视频家族目前拥有三款产品:「立刻 MV」服务音乐创作者,把一首歌变成一支 MV,覆盖网页、iPhone、安卓、微信小程序;「立刻修相片」服务每个家庭,提供老照片修复、上色、照片动起来、开口唱等能力;「立刻成片」服务更广泛的内容生产者,从一句话直达一条能发布的成片。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.