谷歌似乎正在筹备一款全新的Gemini视频生成工具,命名为“Omni”。
近期曝光的一张Gemini视频生成功能标签页截图中,出现了这样一行文字:“从一个创意开始,或套用模板。由Omni提供技术支持。”
![]()
这一标识位置颇具深意:Omni出现在现有工具Toucan的旁侧。
Toucan是目前仍在运营的视频生成工具,由Veo模型驱动,早在2025年谷歌开发者大会举办前,就已被外界发现。
目前,Gemini的视频生成功能由Veo 3.1提供支持,图像生成则依托Nano Banana 2和Nano Banana Pro两大模型。
谷歌介绍称,Nano Banana Pro基于Gemini 3打造,而Nano Banana 2则由Gemini 3.1极速图像模型(Gemini 3.1 Flash Image)驱动。
目前尚存一个疑问:Omni究竟是Veo模型的全新封装版本、一款独立的Gemini视频新模型,还是谷歌迈向Gemini全能大模型的早期布局——未来可在同一系统内统一处理图像与视频生成任务。
由于Omni已经出现在界面可见的文字文案中,而非仅存在于后台隐藏代码里,它很有可能会作为正式面向公众的产品名称推出。
若传闻属实,Gemini将成为首款支持视频输出的顶级全能大模型!
![]()
谷歌当前采用模型分拆策略:视频生成交由Veo负责,图像生成则由基于Gemini的Nano Banana系列模型承担。而Omni有望将这两大技术赛道整合打通。
与此同时,AI视频领域竞争日趋激烈,字节跳动的Seedance 2.0已登顶多项视频生成基准测试榜单,阿里的 happyhorse 又后来居上、来势汹汹。
业内重点关注的预计发布时间窗口为2026年谷歌开发者大会。谷歌已官宣本届大会将于5月19日至20日举办,届时将发布Gemini及全线AI产品更新,这也为谷歌重磅揭晓Gemini多媒体生成新功能提供了绝佳舞台。
新版 Gemini(3.2/3.5)据报道也正在测试中,专注于更快、更高效的性能。
基于一个新的记忆功能(“Teamfood”), Gemini Ultra 预计将演变为一个更注重内存、长上下文的系统,用于一致的多步骤工作流程。
订阅层级则可能转向更清晰的 Advance / Pro / Ultra 结构。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.