Google于当地时间2026年8月27日发布视频生成AI“Gemini Omni 1.1 Flash”。这是该公司面向开发者的最新多模态模型,用于视频生成与编辑,并带来一组新的创作能力与控制选项。
支持文本、图像与参考视频输入
![]()
Gemini Omni 1.1 Flash支持从文本生成视频,也允许用户用开始帧和最终帧的图像来指定镜头,还可以输入最长3秒的参考视频来生成新内容。对于已有视频,模型能够分析最多10秒的前序画面,从原片段结束处继续延展场景。
低分辨率草稿先行,再生成720p
新模型提供360p低分辨率快速预览,用于在打磨提示词阶段以更低成本测试视频创意。用户可以先在360p下快速生成草稿,待提示词确定后再生成720p版本。Google表示,这种方式让开发者不必在测试阶段消耗过多预算。
最高4K输出,面向专业制作
除了720p,Gemini Omni 1.1 Flash还可以将生成结果升频至1080p或4K分辨率。Google称,这些高分辨率输出可用于专业制作场景。
第三方盲测:文本生成视频排第一
第三方机构Arena进行了一项盲测,让人类在不知道模型名称的情况下评估视频生成结果。在文本生成视频类别中,Gemini Omni 1.1 Flash排名第一;在图像生成视频类别中,它排在开放模型MiniMax H3之后,位列第二。
可用渠道与按秒计费
Gemini Omni 1.1 Flash现已在Google AI Studio提供,也可通过API使用。API费用按生成视频的秒数计算:360p每秒0.03美元,720p每秒0.10美元,1080p每秒0.15美元,4K每秒0.30美元。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.