字节Seedance 2.5发布,一次能生成30秒视频了
![]()
做短视频的人最近应该感受到了,AI生成视频的时长门槛一直在被推高。7月31日,字节跳动正式公告,在国内推出Seedance 2.5视频生成模型。最抓眼球的数字就一个:单次可以生成30秒的高质量视频片段。跟之前比,这是把单次时长直接翻了一倍。
先搞清楚这个模型是干嘛的。Seedance是字节旗下的视频生成模型,2.5这一代延续了2.0那套"多模态音视频联合生成"的架构,但重点升级了三件事:长叙事能力、多模态参考能力、还有编辑能力。翻译成人话就是,它现在更会讲一段有头有尾的故事,而不是只给你一个几秒钟的漂亮空镜。
![]()
30秒意味着什么?在AI视频这个圈子里,时长一直是硬伤。早几年模型大多卡在3到5秒,剪出来像GIF。后来到10秒、15秒,能做点表情包和短广告了。现在一口气到30秒,普通一条口播、一段产品演示、一个小剧情片段,基本可以在一次生成里成型,不用再靠把好几段拼起来凑时长。对真正拿来干活的人来说,省的不只是时间,还有拼接时的那股割裂感。
字节给的落地路径也很清楚:Seedance 2.5会陆续上线即梦AI和豆包专业版,API服务近期接入火山方舟。也就是说,普通用户在即梦、豆包里就能用上,开发者通过火山方舟的接口也能接进自己的产品。这种"自家App先用、再开放API"的打法,字节已经玩得很熟了。
多模态参考是另一个看点。新模型支持用户一次性传最多30张图片、10段视频、10段音频作为参考素材。举个例子,你想让生成的视频里人物穿某件特定衣服、场景是某张参考图的风格,就可以把这些素材喂进去。这对做电商展示、动漫二创、游戏宣发的人特别有用,因为可控性比纯文字描述强太多。
放到整个行业里看,Seedance 2.5的发布时间点很微妙。就在同一天前后,MiniMax也发布了首款开源多模态生成模型H3,支持2K分辨率直出和最长15秒音画内容生成,而且把视频生成价格压到了0.8元每秒。可灵、Runway、Sora也都在各自的节奏上迭代。视频生成已经从"谁先跑通"进入了"谁更便宜、更长、更可控"的肉搏阶段。
不过也得说实话,30秒听起来很长,真要用来做一条完整成片还是不够。一部像样的短片,哪怕一分钟都得拼好几段,还要考虑镜头之间的连贯、人物脸别崩、手指数对。Seedance 2.5强调的"长叙事"是在往这个方向补,但离"丢一句话就出一支广告片"还早。官方也没回避,长视频的一致性本来就是全行业的难题。
对内容创作者来说,最现实的变化是:以后剪一条抖音、视频号的小片子,脚本和分镜可能真能交给AI先出个毛片,你再在上面改。成本下降加上时长翻倍,会让"用AI做视频"从尝鲜变成日常工具。接下来的变量是价格————字节这次没在公告里把单价说死,但参照同行往每秒几毛钱卷的趋势,用户大概率会是受益方。
不管怎么说,Seedance 2.5把单次30秒这件事摆上台面,说明国产视频模型的军备竞赛又往前拱了一步。今年下半年,这块只会更热闹。
来源:字节跳动官方公告(2026年7月31日)、极客公园《极客早知道》(2026年8月1日)、陆家嘴财经早餐(2026年8月1日)
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.