“过去两年AI行业的核心命题是生成,生成文字、图像、视频、音乐。从2026年开始,AI的核心命题将转向理解与交互。”7月19日,在2026世界人工智能大会(WAIC)“世界模型与多模态范式跃迁”专场论坛上,昆仑万维董事长兼CEO方汉表示,让AI真正理解物理世界的运行规律,并能与真实环境进行闭环互动,世界模型正是实现这一跨越的关键技术底座。
![]()
昆仑万维董事长兼CEO方汉。
方汉表示,世界模型将走出屏幕,进入物理世界。具身智能正从实验室走向真实环境,这一趋势要求机器人在行动前先进行环境推演,能够预判动作后果、评估环境变化、及时调整应对策略。这种能力的突破将使竞争焦点从单一任务转向陌生环境下的通用模型能力。谁能训练出在复杂场景中依然看得懂、做得对的模型,谁就拿到物理智能时代的入场券,这也是中国智能制造和机器人产业真正亟需的底层能力。
他认为,游戏行业将率先被世界模型改变。未来3-5年,世界模型将成为游戏行业的基础设施,刷新内容生产方式,而国产模型已在这一赛道领跑全球。AI音乐、AI视频等工具将从技术试验变成大众创作工具,促进AIGC的深层发展,让普通人也能把模糊灵感转化为有情绪、有温度的作品。这并非替代音乐人,而是大幅降低创作门槛,让更多人释放表达,改变音乐乃至AIGC产业的创作生态。
在WAIC期间,昆仑万维推出Matrix-Game 3.5世界模型,5B模型在720p分辨率下可实现单卡20FPS实时生成,具备1分钟记忆能力,模型核心架构开源。音乐大模型Mureka v9.5负责把歌做得更自然,O3负责让模型在交付前多看多想多修,通过持续推演、回看偏差和修正后续决策,强化旋律发展、编曲结构与指令理解,使歌曲结构完整、情绪连贯、段落关系合理。
Mureka音乐大模型还将音乐与视频MV接进同一条创作链路。用户可以提供一张图或一段视频,让系统理解画面的节奏、人物、空间和情绪,再生成与之匹配的音乐。也可以从一首歌开始,让智能体理解歌词叙事、节拍编曲和情绪起伏,继续生成角色与MV的视觉方案。
![]()
圆桌环节。
对于AI的体验,演员王珞丹认为,创作者首先是一个判断者和决策者,需要用审美去筛选和决定最终呈现的画面,而AI能带来超出想象的运镜和流动性。她相信观众在意的是故事能否打动人心,而非媒介形态,创作者始终是表达的核心。
中国电影家协会副主席黄晓明提到自己曾看了一部朋友制作的AI电影,三个月前看时还能明显看出AI表演的痕迹,但最近再看时,即便被告知那是AI生成,他已经完全分辨不出来,“细节到脸上的斑点毛孔,甚至微表情、毛孔都在演戏。”从创作到投资,他对AI保持开放态度,表示很想投资与AI相关的项目,无论是科技方向还是影视方向。
青年导演崔睿表示,AI已在实际创作中显著提升了前期故事板的制作效率,让导演能以更低成本、更短时间完成视觉预演;后期阶段,AI还能有效补足因天气等客观因素无法实拍的镜头缺失。在他看来,AI在影视制作中最能发挥价值的场景,恰恰是那些人力成本最高、执行最烦琐的“技术难题”,比如需要成千上万群演的大场面,这正是AI最擅长解决的领域。整体来看,他认为AI视频工具值得创作者尝试和使用。
爱奇艺高级副总裁杨海涛表示,爱奇艺后台每日收到超3000部AI短剧与上千部AI漫画,AI内容观看数据持续提升。在AI制作中,从导演构思到成片可节约三周以上时间,他预计暑期将上线更多由AI参与的网络故事片。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.