网易首页 > 网易号 > 正文 申请入驻

硬刚 Sora 2,谷歌的 Veo 3.1 确实有小惊喜|AI 上新

0
分享至

用了 5 个月时间,Veo 往前走了 0.1 步。


作者|徐珊

编辑|靖宇

谷歌最新视频生成模型 Veo 3.1 来了!今日上手可用。

北京时间 10 月 16 日,谷歌在 Gemini API 中发布了 Veo 3.1 和 Veo 3.1 Fast 付费预览版。模型一上线,就受到了行业的高度关注。毕竟,和前不久发布的 Sora 2 一样,这次 Veo 3.1 也新增了音频功能。

相较于上一代 Veo 3 来说,Veo 3.1 此次提升主要聚焦在三大方面:

第一,是 AI 生成视频从默片走向有声电影。Veo 3.1 不但能够要求 AI 视频实现声音画面统一,还能够要求 AI 更好地理解画面内容,并给予合适的配乐。

第二,Veo 3.1 可以直接设定 AI 视频的开篇画面和结尾画面。如此一来,Veo 3.1 不但能够实现短视频和短视频之间的过渡自然,也能够进一步控制 AI 视频的首尾观感。甚至,Veo 3.1 可以实现每一个新的视频都是基于上一个视频的最后一个画面继续生成。在无限叠加的 Buff 下,谷歌用一种另类的方式实现了「AI 长视频」生成。

比如说,当你告诉 Veo 3.1,以下两张图片是 AI 视频的开篇画面和结尾画面:

来源:谷歌官网

就会生成如下视频片段:

来源:谷歌官网

第三,Veo 3.1 可以通过三张图打造一个人设。

当你给 Veo 3.1 三张图片,分别为一个女性头像、一个服装参考图以及一个场景设定时,根据提示词要求,Veo 3.1 可以直接通过三张画面设定 AI 人物形象,并且可以让该人物自然地说出目标台词。

来源:谷歌官网

此次,Veo 3.1 主打进一步优化 AI 视频在视听观感上的体验。同时,谷歌也是在 AI 视频生成片段时间较短的前提下,寻找能够实现「AI 长视频叙事」的解法。

栏目作者召集

极客公园的新栏目「AI 上新」,将带大家体验最新的 AI 应用和硬件,让你成为 AI 时代「最靓的仔」!

现在,我们也向所有喜欢尝鲜和体验 AI 的同学发出召集,只要你发现并体验了新的 AI 应用或者功能,按照格式(参考案例:)向栏目投稿,在极客公园公众号发布,不仅能获得相应稿费,且会为你「报销」AI 应用的订阅费用。

同时,优秀作者还有机会进入极客公园 AI 体验群,获得最新 AI 应用和工具的内测资格,参加极客公园专属相关 AI 活动,和 AI 应用创始人一对一沟通。

AGI 太久,只争朝夕,让一部分人先 AI 起来吧!投稿、进群请扫描下方二维码添加极客小助手微信

01

亲测 Veo 3.1 三大功能,

五个月谷歌往前走了「0.1 步」

目前,普通用户可在 Gemini 应用程序和 Flow 免费使用,不过使用机会有限。我们发现不少国内 AI 视频生成平台闪现秒跟。不到一天时间,Imagine.art、Fal-ai 以及 Lovart 均表示支持 Veo 3.1 模型调用我们此次也在 Lovart 上对 Veo 3.1 进行了快速体验。

首先测试了 Veo 3.1 生成的 AI 视频是否能够在音画统一上达成一致。第一次,我们给到 Veo 3.1 的英文提示词是:「纽约街头正在下雨,突然一道闪电伴随雷声而来。」

大约一分钟后,我们获得如下视频画面:

可以看到基本上,闪电和雷声是在同一时间内出现,完成了声音画面的一致性。我们还可以更细致地发现每一辆车开过水坑时,声音会有一个从远到近,从大到小的变化程度。让我们意外的是,在 3 分钟左右的生成 AI 视频的倒计时中,Veo 3.1 整个视频的生成时间会在 1 分钟左右就完成,但生成的视频片段基本上都在 6 秒左右,与 Sora 2 可以生成 10-20 秒的时间相比,明显不占优势。

而且,我们还发现在整个画面,只有车、雨滴、和闪电是呈现动态效果,两旁的行人或者树木均是静止不动的,因此整个视频片段会出现一些违和感,让人能够一眼能看出是 AI 视频。

接下来,我们测试给 Veo 3.1 两张照片,并分别设定为第一张照片和最后一张照片后,看看 AI 视频的首尾稳定性如何。以及 Veo 3.1 能否能够通过拼接的方式,实现两段视频直接连接。

为了更好的生成效果,我们给到 Veo 3.1 的第一段提示词是:「一只顽皮的虎斑猫以流畅、连续的动作跃上办公桌。这个动作应展现从起跳到优雅落桌的完整跳跃弧线,以上两张图片分别为视频的首个画面和结束画面,确保运动过程流畅且符合物理规律。」

在大约 1 分钟后,Veo 3.1 给出视频效果是:

在视频的前半部分,呈现基本上自然。但是在小猫咪跳到电脑后面的时候,似乎变了另一只小猫出来,整个视频突然添了几分「魔法感」。并且,在视频的最后几秒,似乎有个开灯设定,将画面调整更亮。

同时,我们给出 Veo 3.1 第二段英文提示词:「跳上办公桌的虎斑猫趴下睡着了。以上两张图片分别为视频的首个画面和结束画面,确保运动过程流畅且符合物理规律。」

在 2 分钟后,Veo 3.1 给出一段 6 秒的短视频:

可以看出,Veo 3.1 给出的 AI 生成视频还是比较真实的。如果将两个视频片段连接在一起,则呈现的效果为:

可以看出,当两个视频拼接到一起之后,除了此前提到的「魔法感」比较突兀外,视频与视频之间还是保持了连贯性,并且也实现了一定程度上的场景拓展。

最后,我们测试了如何使用 Veo 3.1,通过三张图设定一个人物主角形象。

我们给出一段英文指令,大意为:「一个中景镜头,画面中的女性角色来源于人物参考图,身穿服装参考图中的衣服。她正在场景参考图中的场景里漫步,带着好奇而愉悦的表情环顾四周。环境需与提供的场景图一致。整体风格应为电影质感,拥有自然的光线和轻柔的微风。同步生成环境音效,如树叶的沙沙声和远处的鸟鸣。」

Veo 3.1 给出的视频效果为:

来源:极客公园

可惜的是,这一次我们发现 AI 视频中的人物明显建模感严重,服装和场景几乎都与此前给出的参考图片有明显差别,AI 感极重,该 AI 视频几乎是此次所有测试视频里面表现效果最差的。

整体看来,此次 Veo 3.1 在音画同步以及首尾画面稳定上均给出不错的 AI 效果。但在用图片设定人物形象,AI 人设方向并没有官网中介绍的效果好。

02

谷歌「暗踩」Sora2,

AI 大佬们跳出来反对

「胜,大获全胜。」谷歌试图在官网昭告天下这一点。据谷歌介绍,谷歌在文生视频的总体观感、视频对齐程度以及视觉质量等方面,完胜 Sora 2 Pro、海螺 2.0、Seedance 1.0 Pro 和 Renway Gen 3 等一众视频模型。

官网还强调,在音画一致性方面,Veo 3 的「视频素材」功能在内部基准测试中,在「整体偏好」和「视觉质量」两项指标均名列前茅。

有意思的是,谷歌官网还悄悄地「暗踩」OpenAI 所发布的 Sora 2,解释在图像转视频测试中没有 Sora 2 Pro 的原因是因为 Sora 2 Pro 目前不支持人像生成。

不过我们也发现在此次的对比中,谷歌似乎模糊 Veo 3.1 和 Veo 3 的模型边界,基于所有的图片显示中都是 Veo 3,而文字表达均为 Veo 3.1,因此暂时也很难确定此次评测的模型,究竟是刚刚发布的 Veo 3.1 还是 5 个月前的 Veo 3。

尽管谷歌自我感觉甚好,但在 AI 大佬们看来,Veo 3.1 的效果似乎略逊于 Sora 2。比如说,Otherside AI 的创始人 Matt Shumer 直接在推特上表示对 Veo 3.1 感到「有些失望」,他认为 Veo 3.1 效果明显逊于 Sora 2,价格却高出不少。毕竟,目前 Sora 2 可是免费使用。

3D 数字艺术家 Travis David 则提到 Veo 3.1 并没有突破 AI 视频生成的「8 秒」定律,且用户没有办法自己选择生成什么样的音频,让人大失所望。

还有不少网友提到期待「自动化分镜」功能迟迟没有上新,在自动化程度的进展也让人感到失望。

03

和 Sora 2 Pro 卷「性价比」?

Veo 3.1 瞄准 AI 视频专业化

在谷歌介绍 Veo 3.1 模型博客的最后,提到了价格与 Veo 3 相同。乍一看,我还以为谷歌此次是一次「加量不加价」的升级,但仔细研究之后发现,Veo 3.1 模型可能仍是目前市场较为昂贵的视频生成模型,仅次于 Sora 2 Pro。

除了 Veo 3.1,谷歌还推出 Veo 3.1 Fast,能够更快的生成视频,价格也更低,不含音频的版本是每秒$0.15,加上音频生成的版本则是每秒$0.40 美元。

而在价格表下,谷歌也为自己留出了一条后路,提到「在某些情况下,音频处理问题可能会导致视频无法生成。只有在成功生成视频后,系统才会向您收取费用。」这也能够说明一定程度上,该视频模型仍处于不稳定的状态中。

和前不久刚刚发布社交属性较强、更注重趣味感的 Sora 2 相比,Veo 3.1 明显定位在「专业化」上。因此,Veo 3.1 更强调视频的连贯性,音画的一致性以及人物的稳定性。

谷歌给出的应用场景案例也侧面印证了这一点。据介绍,GenAI 电影工作室 Promise Studios 已经开始其 MUSE 平台中使用 Veo 3.1 来增强生成 AI 视频故事性,整体生成视频要求尽可能达到导演希望的制作质量以及故事讲述感。AI 生成内容公司 Latitude 也正在其生成叙事引擎中测试 Veo 3.1,希望能够将用户创作的故事立即变为现实。

可以看到,Veo 3.1 正试图撬动专业影视制作领域,降低高质量视频创作的门槛和成本。这也意味着未来个人创作者或小团队,有机会通过叙事控制、定制化角色以及音画一致性,独立制作一系列风格统一的迷你短片或系列视频内容。

但从整体视频生成效果来看,五个月谷歌在 Veo 视频模型上往前仅走了「0.1 步」。

*头图来源:谷歌官网

本文为极客公园原创文章,转载请联系极客君微信 geekparkGO

极客一问

你用了 Veo 3.1 和 Sora 2 哪个效果更好?

雷军呼吁:共同抵制网络水军、黑公关,推进行业健康发展

点赞关注极客公园视频号,

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
“充会电”成最后遗言:33岁父亲为家赴泰,再现身已被按头打电话

“充会电”成最后遗言:33岁父亲为家赴泰,再现身已被按头打电话

奇思妙想草叶君
2026-06-27 03:05:24
难以置信!河北一考生发帖怒斥,班主任在高考结束就删除家长微信

难以置信!河北一考生发帖怒斥,班主任在高考结束就删除家长微信

火山詩话
2026-06-27 08:45:13
俄罗斯前国防部长意外去世,死因尚未公布

俄罗斯前国防部长意外去世,死因尚未公布

爆角追踪
2026-06-26 22:52:14
世界杯32年奇观!40岁门将半场被撤:70岁老帅气炸了 队友摊手抱怨

世界杯32年奇观!40岁门将半场被撤:70岁老帅气炸了 队友摊手抱怨

风过乡
2026-06-27 09:45:18
每体:贝尔萨知道无论如何都得离任 等开踢再换巴尔韦德将矛盾公开

每体:贝尔萨知道无论如何都得离任 等开踢再换巴尔韦德将矛盾公开

画夕
2026-06-27 10:31:04
令人绝望!连非洲兄弟都来踩一脚,韩国已跌至第7,就怕2场默契球

令人绝望!连非洲兄弟都来踩一脚,韩国已跌至第7,就怕2场默契球

萌兰聊个球
2026-06-27 08:07:08
又匹配两对,世界杯1/16决赛:德国vs巴拉圭,法国vs瑞典

又匹配两对,世界杯1/16决赛:德国vs巴拉圭,法国vs瑞典

懂球帝
2026-06-27 10:44:11
亏大了!安徽考生高考使用修正带,数学判0分,总分458分超本科线

亏大了!安徽考生高考使用修正带,数学判0分,总分458分超本科线

火山詩话
2026-06-26 05:41:30
活久见!女子晒出丈夫监狱账户收支明细,130元劳动报酬,引热议

活久见!女子晒出丈夫监狱账户收支明细,130元劳动报酬,引热议

火山詩话
2026-06-26 15:19:53
克林顿爆粗、奥巴马翻白眼、特朗普开骂…5个美国总统没一个能收拾内塔尼亚胡

克林顿爆粗、奥巴马翻白眼、特朗普开骂…5个美国总统没一个能收拾内塔尼亚胡

可达鸭面面观
2026-06-26 18:25:33
湖南郴州这家学校老师都是法盲!将没收来的上百部学生手机当众砸毁

湖南郴州这家学校老师都是法盲!将没收来的上百部学生手机当众砸毁

黄河新闻网吕梁
2026-06-26 17:28:27
中国移动空调欧洲断货,免安装为何能绕过3000欧元安装费壁垒?

中国移动空调欧洲断货,免安装为何能绕过3000欧元安装费壁垒?

小柱解说游戏
2026-06-27 03:42:28
世界杯:佛得角0-0创历史!首次参赛就出线+将战阿根廷 沙特出局

世界杯:佛得角0-0创历史!首次参赛就出线+将战阿根廷 沙特出局

念洲
2026-06-27 10:09:07
震惊!保时捷车主与三轮车主互殴视频登热搜,一年轻美女全程围观

震惊!保时捷车主与三轮车主互殴视频登热搜,一年轻美女全程围观

火山詩话
2026-06-27 05:52:38
这就是赤裸裸的现实!为什么突然要求核查央国企近二三十年工作?

这就是赤裸裸的现实!为什么突然要求核查央国企近二三十年工作?

椰青美食分享
2026-06-26 13:51:31
一场1-0让两个国家狂欢!人口60万小国出线,韩国看到希望!

一场1-0让两个国家狂欢!人口60万小国出线,韩国看到希望!

绿茵舞着
2026-06-27 11:09:17
江西财经大学事件:“把你打到无法行走”、“每延迟一天拔一片指甲”、“让你怀孕再逼你流产。”

江西财经大学事件:“把你打到无法行走”、“每延迟一天拔一片指甲”、“让你怀孕再逼你流产。”

贴小君
2026-06-27 01:13:40
动容!佛得角全队庆祝似夺冠 7万球迷狂欢 40岁门神激动扛起队友

动容!佛得角全队庆祝似夺冠 7万球迷狂欢 40岁门神激动扛起队友

我爱英超
2026-06-27 10:56:29
成本20卖3000,555亿身家的山东美女富豪,凭什么收割爱美女性?

成本20卖3000,555亿身家的山东美女富豪,凭什么收割爱美女性?

青眼财经
2026-06-27 08:00:24
世界杯太残酷了:随着西班牙1-0,首支出局的南美球队诞生

世界杯太残酷了:随着西班牙1-0,首支出局的南美球队诞生

侧身凌空斩
2026-06-27 10:03:18
2026-06-27 12:20:49
极客公园
极客公园
让最棒的创新成为头条
12201文章数 78910关注度
往期回顾 全部

科技要闻

GPT-5.6发布,旗舰模型先向可信伙伴开放

头条要闻

三战三平佛得角小组第二晋级 下一场挑战阿根廷

头条要闻

三战三平佛得角小组第二晋级 下一场挑战阿根廷

体育要闻

我在世界杯的每次奔跑,都为了证明你没看错

娱乐要闻

杨紫获白玉兰最佳女主角奖,泪洒现场

财经要闻

OpenAI推迟IPO重创软银!

汽车要闻

11.99万起 捷途自由者7 PLUS/山海T1四驱版上市

态度原创

亲子
健康
家居
公开课
军事航空

亲子要闻

甲酰胺纸尿裤,暴露了被价格战卷疯的产业链

“无糖汤圆”是否隐藏着健康陷阱?

家居要闻

绿意盎然 自然之境

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

黎以美达成三方框架协议

无障碍浏览 进入关怀版