8月24日晚间,AI视频生成平台Runway正式宣布上线WAN 3.0模型,支持视频与音频的生成能力。这一更新意味着创作者现在可以在Runway平台上直接调用WAN 3.0,完成从画面到声音的一站式内容生产。
多模态参考输入成亮点
![]()
据Runway官方发布的信息,WAN 3.0此次支持多张图片、视频和音频参考输入。也就是说,用户不再局限于单一的文字提示词驱动生成,而是可以同时上传多种素材作为生成依据,让模型在理解画面风格、内容结构的同时,也能参考音频特征进行输出。
这种多参考输入的设计,在实际创作中意味着更高的可控性。例如,创作者可以提供一张角色设定图、一段场景视频和一段背景音乐,让模型综合这些信息生成一段风格统一、音画同步的新内容。
视频与音频生成能力同步上线
与以往仅聚焦视频生成不同,WAN 3.0在Runway上的部署同时覆盖了视频生成和音频生成两条能力线。官方表述为"生成最先进的视频和音频",并强调两者可以结合使用。
从产品逻辑上看,这补齐了AI视频创作中声音环节的短板。此前,创作者往往需要先生成视频画面,再借助其他工具单独处理配乐或音效,流程相对割裂。WAN 3.0将音频生成纳入同一生成流程,有望简化这一工作链路。
上线即用,入口已开放
Runway官方在公告中表示,用户现在即可通过下方链接在平台上体验WAN 3.0。从发布时间的措辞来看,该功能属于正式上线而非内测或限量开放,Runway用户可以直接尝试。
截至发布时,该条公告在社交平台上已获得1700余次浏览,关注度正在快速上升。
对创作者意味着什么
对于依赖AI工具进行内容生产的个人创作者和中小团队来说,WAN 3.0登陆Runway带来的直接变化是:工具链进一步收拢。过去需要多个平台协作完成的"画面+声音"生成任务,现在有了在单一平台内完成的可能。
同时,多参考输入的支持也降低了精确控制生成结果的难度。创作者可以通过提供更具体的视觉和听觉参考,减少反复调整提示词的试错成本。
不过,目前官方尚未公布WAN 3.0在Runway上的具体定价策略、生成时长限制以及分辨率支持范围等细节。实际生成效果和用户体验,仍有待首批创作者上手验证。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.