今天,字节跳动视频创作模型 Seedance 2.5 正式发布。
相比此前版本,Seedance 2.5 延续了统一的多模态音视频联合生成架构,并在长叙事、多模态参考和精准编辑三大方向实现升级:
模型单次可生成最长 30 秒高质量视频,并支持多轮延长,用户可以在已有结果基础上继续生成后续镜头,同时保持人物、场景、风格、声音和叙事节奏的连贯,最终完成数分钟具有统一视听语言的内容。这意味着,过去需要拆分镜头、反复拼接、处理转场的创作流程,正在被进一步压缩。
Seedance 2.5 还强化了镜头衔接、场景过渡、画质、音质和运动质量,并针对AI视频中常见的“油腻感”进行了系统优化,让人物肤质、眼神、材质、光影和画面饱和度更接近实拍质感,减少不受控字幕和背景音乐带来的干扰。
在多模态参考方面,Seedance 2.5 支持用户单次输入最多 30 张图片、10 段视频和 10 段音频,能够综合理解不同素材中的人物、场景、构图、道具、风格和声音,并按创作指令生成多主体、多场景、多镜头变化的复杂视频内容。
无论是音乐会群像、京剧舞台调度,还是白模参考下的复杂空间运动,模型都能更稳定地还原主体特征、镜头节奏和光影关系,让创作者脑海中的想法更可控地落到画面中。
与此同时,Seedance 2.5 的编辑能力也进一步增强,支持通过时间戳精准控制音视频内容,用户可以指定某个时间段发生的剧情、动作、视角和运镜,也可以在生成后对局部片段中的角色、动作、声音或情节进行定向修改,并保持前后画面的连贯性。
模型还提升了绿幕编辑、视角编辑、运镜编辑和参考编辑能力,在影视、广告等专业场景中具备更高实用价值。例如,创作者可以在保持人物动作不变的情况下替换背景场景,也可以仅调整一段视频的镜头运动,使其更符合成片节奏。
值得注意的是,Seedance 2.5 的应用边界正在从内容创作延伸到教育、工业、具身智能和自动驾驶等更广泛的产业场景。
在教育领域,它可以将历史背景、文学内容、科学原理和实验过程转化为更具沉浸感的视频,帮助老师降低教学素材制作门槛;在工业制造中,它可以用于流程培训、设备演示和工业仿真;在机器人与自动驾驶场景中,它还能生成高质量合成视频数据,模拟复杂路况、极端天气和低频场景,为系统训练和测试提供样本。
Seedance 团队表示,新版本让视频生成从片段级输出进一步走向完整创作流程,也让模型更懂用户意图、更接近真实世界表达。未来,团队将继续探索更长的连贯叙事、更懂用户的生成与编辑体验,并增强模型对物理世界规律的理解。
目前,Seedance 2.5 正在陆续上线即梦AI、豆包专业版等平台,API 服务也将在近期上线火山方舟。对创作者而言,这次升级的真正变化不只是“视频能生成更长了”,而是AI开始更像一个能理解素材、组织故事、调度镜头并参与后期修改的创作伙伴。
对此,你怎么看?欢迎评论区一起聊聊。
PS:见实仍在继续中,有「老会员半价续费」等系列福利,欢迎你下方一起参与。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.