![]()
seedance2.5生成画面
字节跳动又放了一颗“卫星”。
从2024年初Sora引爆全球算起,视频生成赛道经历了两年多的爆发式增长。国内从“百模大战”到“百视频大战”,字节、快手、阿里悉数入局,初创公司争先融资。然而,技术的狂奔并未直接转化为产业的落地。用户输入一句提示词,模型生成一段画面,新鲜感迅速消退后,绝大多数人发现,这些工具很难真正嵌入创作流程。
广发证券测算,AI视频模型行业收入规模预计2026年达77亿美元,2030年有望提升至827亿美元。蛋糕足够大,但谁能吃到最大的那一块?行业正在形成一个共识:视频生成的竞争,正在从“能不能生成”走向“能不能交付”。
用Seed团队自己的话说:“Seedance 2.0发布后,我们观察到,用户对视频创作模型的期待正在从‘生成一个片段’走向‘完成一段创作’。”
7月31日,Seedance 2.5正式发布。单次生成30秒、支持最多50个多模态参考素材、新增白模和绿幕参考能力、支持精准时间戳编辑。参数层面的升级固然亮眼,但真正值得关注的,是这些能力背后的战略转向:Seedance2.5正在把视频生成从“玩具”变成“工具”,从“创意辅助”推向“产业交付”。
![]()
从“片段”到“叙事”:Seedance 2.5的产品进化
过去两年,视频生成赛道经历了一轮快速的技术迭代。从单次生成5秒到10秒再到15秒,画质从模糊到清晰再到逼近实拍,行业用两年时间走完了传统视频制作技术几十年的演进路径。但技术指标的突破终究有节奏,从5秒到10秒是质的飞跃,从10秒到30秒是能力持续深化。
现在行业已经站在一个新的起点上,基础能力不再是瓶颈,真正的命题变成了:模型能不能从“生成一个画面”进化到“讲好一段故事”。
Seedance 2.5的三个核心升级,全部指向这个方向。
单次生成从15秒提升到30秒,意义不在数字翻倍,而在于模型第一次拥有了完成一个完整叙事单元的能力。15秒只够呈现一个动作,30秒足够完成铺垫、推进、转折、收尾的完整结构。官方演示的歌手登台案例很直观:一镜到底从化妆间到后台通道、与舞伴互动、最终登台演出。过去AI视频只能做到“歌手上台”,现在能做到“从化妆间到舞台的完整旅程”。前者是画面,后者是故事。
![]()
多轮延长能力进一步放大了这种可能性。用户可以在已有视频基础上自然衔接后续镜头,保持主体特征、场景环境和叙事节奏的连贯,最终生成数分钟的统一内容。AI视频创作从一次性的“单次生成”变成了“分场次拍摄、最终剪辑成片”的类电影工作流。画质层面,材质、肤质、光影、饱和度的优化让成片少了“AI跑出来”的生硬感,多了“拍出来”的真实感。
多模态参考是另一个关键升级。视频生成真正的门槛在于“对齐”,用户想象中的画面和模型输出的结果之间,始终存在一道鸿沟。Seedance 2.5的解法是:让用户一次性上传最多30张图片、10段视频、10段音频作为参考素材,模型综合理解其中的构图、场景、风格、人物、道具,再按指令生成视频。在多人群像、音乐会等复杂场景中,也能同时还原多个人物的形象与声音。
白模参考是这项能力中最具突破性的部分。用户可以用无纹理3D模型搭出空间结构、主体姿态、运动轨迹和镜头机位,模型再基于这套结构完成材质、光影和风格渲染,同时根据白模的空间信息生成符合物理规律的光照效果,包括光源方向、色温、强度、阴影投射等。这意味着导演可以不花一分钱拍摄、不做任何渲染,先把镜头的“骨架”搭好,构图、走位、运镜全定下来,然后让模型去填充血肉。用户从“给模型写一段描述”变成了“给模型一套完整的视觉方案”。
![]()
精准编辑能力解决的是另一个长期痛点。过去AI视频只要一个细节出错,整段就得推翻重来,反复生成几十次是常态。Seedance 2.5支持通过时间戳精准编辑:生成时控制某个时间段的画面视角、运镜和节奏;生成后对指定片段的人物、动作、声音进行定向修改,同时保持前后连贯性。绿幕编辑能在替换背景时同步调整人物身上的光影、衣服飘动方向、步态节奏,让主体和场景更加自然。这意味着AI视频从“一次性生成物”变成了可反复修改的“工程文件”,广告、电商、短剧团队的返工成本有望大幅下降。
这三个升级指向同一个方向:生成结果变得可控、可编辑、可交付。从片段到叙事,从场景到故事,Seedance 2.5正在解决的,正是如何让创作者真正把这些工具用起来。
可控意味着创作者不再靠“抽卡”碰运气;可编辑意味着视频生成不再是一次性的“黑盒输出”,迭代成本被大幅降低;可交付则意味着品质稳定到足以进入生产管线。
这不仅是技术迭代,更是产品哲学的分水岭,从“让AI生成令人惊叹的东西”转向“让AI生成你真正想要的东西”。当控制权从模型手中交还给创作者,视频生成的想象力才真正开始。
![]()
具体到场景,教育领域已率先落地,将课文背后的历史背景、人物和情节转化为视频内容,让静态讲解变成沉浸式画面,工业、电商等领域也在同步推进。从创意到生产力的跨越,是Seedance 2.5最重要的战略信号。
![]()
赋能产业,AI视频带来更多确定性
Seedance 2.5从内容产业跨入实体产业,这件事本身比技术参数重要得多。
发布当日,徐工集团、小鹏汽车、智元机器人、灵初智能、微分智飞、穹彻智能等多家企业已与火山引擎达成合作意向。徐工集团把数万到数十万元的传统SOP视频制作流程大幅压缩;小鹏汽车将Seedance集成至设计平台辅助可视化创作;穹彻智能用Seedance生成机器人训练数据,无需逐一采集。
![]()
这些案例的共同点是:视频生成正在从“拍视频”走向“造东西”,帮具身智能补数据,帮智能驾驶造场景。
这种转向之所以能发生,是因为视频生成的能力正在从“会拍画面”进化到“理解世界”,不再只生成好看的镜头,而是开始懂得物体运动、空间延伸、场景连贯。字节跳动提前看到了这个变化,让Seedance 2.5在底层能力上为此做了准备。
过去两年,行业比的是一段视频好不好看,现在对视频创作有了更高的要求。创作者要的是能连续讲故事、能反复修改,产业客户要的是能替代实拍、能辅助研发、能降低成本的解决方案。
从“生成片段”到“完成创作”,再到“赋能产业”,这个三级跳,可能是视频生成行业未来两年最重要的叙事线。
Seedance2.5在这条线上抢先落了一子。据AI普瑞斯统计,按日消耗占比计算,Seedance已占到市场超八成份额。从C端到B端的完整商业闭环、从内容创作到实体制造的产业渗透,Seedance 2.5不只是产品迭代,是字节跳动对“视频生成如何产业化”这个问题的系统回答。
![]()
格局已定,“一超多强”的决赛圈
2024年初,OpenAI发布Sora,被视为“视频领域的ChatGPT时刻”。
两年多过去,潮水退去。高昂的研发与算力成本迅速淘汰了大部分中小玩家,市场资源向头部集中。国内视频生成赛道已趋于收敛,“一超多强”的竞争格局逐渐清晰。
据相关报道,Seedance在国内视频生成市场已占据绝对优势。按日消耗Token占比计算,市占率超八成,短剧行业渗透率更接近95%;今年6月份,Seedance 2.0在全球视频模型市场的份额排名第二,仅次于谷歌Veo;商业化方面,火山引擎MaaS平台营收从2025年的约15亿元跃升至2026年目标150亿元,十倍增长预期几乎全部来自Seedance的带动。
在视频生成领域,字节跳动已经建立起足够厚的先发优势。
Seedance2.5的优势不在技术单点,在生态。火山引擎提供算力和部署,豆包和即梦提供用户入口和应用场景,Seedance提供底层模型能力,三者形成了一个完整的数据飞轮。更重要的是,全球月活超20亿的抖音和TikTok构成了天然的落地场景和应用反哺通道,Seedance不是一款独立产品,它是字节内容生态里的一块拼图。
再看“多强”阵营。快手可灵是其中最有力的追赶者,2026年7月完成近30亿美元首轮独立融资,投后估值达180亿美元,创全球视频大模型公司单轮最大额融资纪录。可灵背后的投资机构相当豪华,BAT罕见“同台”。与此同时,可灵明确了2031年前完成IPO的硬性时间表。
阿里Happy Horse 1.1于2026年6月上线,主打短剧、电商广告、品牌宣传片四大商用场景。爱诗科技7月完成29.8亿元C轮融资。生数科技的Vidu Q3在国际评测中得分位列中国首位、全球第二。
7月31日,MiniMax H3与Seedance 2.5同日发布。H3在人物一致性、风格保持和指令遵循等核心指标上均有明显提升,定价仅为同类模型的三分之一。与此同时,MiniMax宣布H3将成为首个达到商用级水平并开放权重的多模态视频基座模型。
广发证券测算,2026年上半年国内AI短剧市场规模突破220亿元,全年有望冲击400亿元。
资本在用真金白银投票,AI视频是继AI编程之后,商业化最清晰、最具盈利确定性的赛道。
但决赛圈的竞争才刚刚开始。拿到门票不意味着拿到终局。谁能把技术真正变成产业生产力,谁才能在这场竞速中活到最后。
♡ 「飞娱财经」用心出品
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.