阿里云旗下视频生成模型Wan 3.0正式上线Scenario平台,开发者可调用API生成最长30秒的连续视频片段。
此次更新最值得关注的是原生同步音频能力——画面与声音由模型一次性生成,无需后期单独配音。同时,模型支持多模态输入,包括首帧、尾帧、参考图、视频、音频、文档和URL,创作者可以更灵活地控制生成内容。
![]()
复杂输入思考模式
针对多模态混合输入的复杂场景,Wan 3.0配备了思考模式,能够在生成前对指令进行拆解与规划,提升输出质量。
目前,开发者已可通过Model Studio和Qwen Cloud获取API接入,将视频生成能力集成到自有应用中。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.