网易首页 > 网易号 > 正文 申请入驻

谷歌最强大AI模型Gemini 3来了!推理能力实现重大突破!图像生成、编程与AI搜索全面增强

0
分享至

当地时间11月18日,Alphabet旗下的谷歌正式发布备受期待的该司迄今最强大人工智能(AI)模型Gemini 3,并于发布首日立即在谷歌搜索、Gemini应用程序App及多个开发者平台同步上线,在多个盈利产品中投入使用。这是谷歌首次在新模型发布当天就将其整合到搜索产品中,显示出公司加快AI技术商业化的决心。

Alphabet首席执行官桑达尔·皮查伊当天表示,新AI模型将针对更复杂的问题提供更优答案。"用户只需更少的提示,即可获得所需结果。"此外,新模型在编程、应用开发与图像生成方面的能力也大幅增强。


图片来源:每经记者 郑雨航 摄

Gemini 3将被整合进Gemini应用、谷歌的AI搜索产品AI Mode和AI Overviews,以及其企业级产品。该模型将自周二起向部分订阅用户开放,并将在未来几周更大范围上线。

此次发布距离谷歌推出Gemini 2.5仅八个月,距离Gemini 2.0上线也仅11个月。引爆生成式AI热潮的OpenAI已于今年8月份发布GPT-5。

皮查伊写道:“令人惊叹的是,仅仅两年时间,AI已从单纯处理文本和图像,发展到能够读懂场景。从今天起,Gemini将在谷歌全系产品中全面铺开。”

据谷歌披露的数据显示,Gemini应用目前月活跃用户已达6.5亿,而AI Overviews拥有20亿月活用户。OpenAI则在8月表示,ChatGPT周活跃用户已突破7亿。

谷歌高管在新闻发布会上强调,在衡量人工智能模型性能的几个热门行业排行榜上,Gemini 3处于领先地位。Gemini 3在全球AI模型LMArena排行榜上以1501分的历史最高分登顶,在衡量通用推理能力的Humanity's Last Exam基准测试中获得37.5%的最高分,超越了此前由GPT-5 Pro保持的31.64%纪录。该模型还在数学、多模态理解和事实准确性等多个维度刷新了行业标准。

谷歌AI研究实验室DeepMind的CEO Demis Hassabis表示,Gemini 3是"世界上最好的多模态理解模型",也是公司迄今最强大的智能体和代码生成模型。谷歌CEO Sundar Pichai在博客中称其为"我们最智能的模型",能够"将任何想法变为现实"。

推理能力实现重大突破

Gemini 3在推理能力上取得了显著进步,在多项学术级基准测试中展现出博士水平的表现。该模型在GPQA Diamond测试中获得91.9%的高分,在数学领域的MathArena Apex基准测试中取得23.4%的新成绩,在事实准确性方面于SimpleQA Verified测试中达到72.1%的得分。

在多模态推理方面,Gemini 3同样表现出色,在MMMU-Pro测试中获得81%的分数,在Video-MMMU测试中达到87.6%。这意味着该模型能够高度可靠地处理科学和数学等广泛领域的复杂问题。


谷歌产品负责人Tulsee Doshi表示:"在Gemini 3身上,我们看到了推理能力的巨大飞跃。它的响应深度和细微程度是我们以前从未见过的。"

除标准版本外,谷歌还推出了Gemini 3 Deep Think增强推理模式,该模式在Humanity's Last Exam测试中达到41.0%的成绩,在GPQA Diamond测试中获得93.8%的分数。在ARC-AGI-2测试中,Deep Think模式创下了45.1%的前所未有成绩,展示了其解决新颖挑战的能力。谷歌表示,该模式正在接受额外的安全评估,将在未来几周内向Google AI Ultra订阅用户开放。


开发者工具全面升级

在代码生成领域,Gemini 3被谷歌称为"迄今构建的最佳vibe coding和智能体编码模型"。该模型在WebDev Arena排行榜上以1487分的高分登顶,在衡量模型通过终端操作计算机能力的Terminal-Bench 2.0测试中获得54.2%的分数,在评估代码智能体的SWE-bench Verified基准测试中达到76.2%,远超Gemini 2.5 Pro的表现。

开发者可以通过Google AI Studio、Vertex AI、Gemini CLI以及Cursor、GitHub、JetBrains、Manus和Replit等第三方平台访问Gemini 3。

谷歌同时推出了以智能体为先的全新开发平台Google Antigravity,该平台利用Gemini 3的高级推理、工具使用和智能体编码能力,将AI辅助从开发者工具箱中的一个工具转变为主动合作伙伴。DeepMind首席技术官Koray Kavukcuoglu表示:"智能体可以在你的编辑器、终端和浏览器之间工作,以最佳方式帮助你构建应用程序。"

多模态理解与智能体能力并进

Gemini 3保留了该系列模型从一开始就具备的跨模态信息综合能力,能够无缝处理文本、图像、视频、音频和代码等多种模态信息,并配备100万token的上下文窗口。

Hassabis举例说,如果用户想学习传统的烹饪,Gemini 3可以破译并翻译不同语言的手写食谱,制作成可分享的家庭食谱书。如果用户想了解新主题,可以提供学术论文、长视频讲座或教程,Gemini 3能够生成交互式闪卡、可视化或其他格式的内容帮助用户掌握材料。该模型甚至可以分析用户匹克球比赛的视频,识别改进空间并生成整体动作改善的训练计划。

在智能体能力方面,Gemini 3在测试长期规划能力的Vending-Bench 2排行榜上位居榜首。该模型能够在整整一年的模拟运营中保持一致的工具使用和决策能力,在不偏离任务的情况下实现更高回报。这意味着Gemini 3能够通过结合更深入的推理与改进的工具使用,代表用户导航更复杂的多步骤工作流程,例如预订本地服务或整理收件箱。

发布即上线多个核心产品

谷歌此次采取了积极的产品策略,在Gemini 3发布首日就将其整合到多个核心产品中。这是谷歌首次在新模型发布当天就将其应用于搜索产品,标志着公司AI商业化战略的重要转变。

在搜索方面,AI Mode现在使用Gemini 3来实现新的生成式用户界面体验,包括沉浸式视觉布局、交互式工具和模拟,所有这些都根据用户查询实时生成。在Gemini App中,所有用户都可以使用Gemini 3,Google AI Pro和Ultra订阅用户还可以在AI Mode搜索中使用该模型。

在安全性方面,谷歌表示Gemini 3是其迄今最安全的模型,经历了谷歌AI模型史上最全面的安全评估。该模型显示出更低的谄媚性、更强的提示注入抵抗力,以及通过网络攻击滥用的更好防护。除了根据其前沿安全框架进行的内部测试外,谷歌还与世界领先的领域专家合作进行评估,向英国AISI等机构提供早期访问权限,并获得了Apollo、Vaultis和Dreadnode等行业专家的独立评估。

每日经济新闻综合公开资料

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
为啥感觉广州有点萧条了?网友:希望学学江浙沪地区

为啥感觉广州有点萧条了?网友:希望学学江浙沪地区

带你感受人间冷暖
2026-04-07 00:15:06
全球第一!再等1天来袭,99秒即可满电,媲美保时捷帕拉梅拉,仅售9万多

全球第一!再等1天来袭,99秒即可满电,媲美保时捷帕拉梅拉,仅售9万多

隔壁说车老王
2026-04-07 08:11:49
新冠后遗症的长期侵袭,无数人在不知不觉中深陷困境

新冠后遗症的长期侵袭,无数人在不知不觉中深陷困境

律法刑道
2026-04-01 10:15:47
这个器官能延长人的寿命,但过去医生做手术时会顺手切掉它(不是阑尾)

这个器官能延长人的寿命,但过去医生做手术时会顺手切掉它(不是阑尾)

万物杂志
2026-04-07 06:19:09
王宝强和女友开京牌大G到青岛,冯清人高马大,衬得宝强像小娇夫

王宝强和女友开京牌大G到青岛,冯清人高马大,衬得宝强像小娇夫

八怪娱
2026-04-07 15:02:12
老哈梅内伊的账号突然复活,他到底身亡没有?伊朗用意何在?

老哈梅内伊的账号突然复活,他到底身亡没有?伊朗用意何在?

小冠说娱
2026-04-08 06:10:10
迟重瑞为陈丽华光头36年,竟是因妻子儿子一句话:您光头特别富态

迟重瑞为陈丽华光头36年,竟是因妻子儿子一句话:您光头特别富态

观鱼听雨
2026-04-07 18:58:33
雷军晒了张图,小米把豪车涂装玩成了"隐形联名"

雷军晒了张图,小米把豪车涂装玩成了"隐形联名"

报错免疫体
2026-04-06 16:45:14
放着有软肋的火箭不打,挑森林狼给自己上强度,掘金真不识时务吗

放着有软肋的火箭不打,挑森林狼给自己上强度,掘金真不识时务吗

兵哥篮球故事
2026-04-07 17:01:39
越南战败后,越南专家一语惊人:中国赢了战场,却输了战略!

越南战败后,越南专家一语惊人:中国赢了战场,却输了战略!

奥字侃剧
2026-04-08 06:06:39
销量雪崩下紧急换帅,智界能走出困局吗?

销量雪崩下紧急换帅,智界能走出困局吗?

侃故事的阿庆
2026-04-07 16:31:09
演员陈学冬:11部作品被下架,两年4次手术,今35岁生活无法自理

演员陈学冬:11部作品被下架,两年4次手术,今35岁生活无法自理

以茶带书
2026-04-03 19:40:21
遗憾!中国航天又一次发射失利,损失一枚大火箭

遗憾!中国航天又一次发射失利,损失一枚大火箭

深蓝财经
2026-04-05 21:11:48
2年前,那个砸神像、睡坟场“八字命硬”的网红,如今却变相了?

2年前,那个砸神像、睡坟场“八字命硬”的网红,如今却变相了?

天天热点见闻
2026-03-30 06:53:48
香蕉被点名!医生:香蕉放黑 2 天,抗性淀粉翻倍,控糖护肠

香蕉被点名!医生:香蕉放黑 2 天,抗性淀粉翻倍,控糖护肠

岐黄传人孙大夫
2026-04-06 21:25:03
晚节不保?杨亚洲也没想到,倪萍如今会以这种方式让人操碎了心

晚节不保?杨亚洲也没想到,倪萍如今会以这种方式让人操碎了心

阿纂看事
2026-04-07 14:28:10
要动手了?中国在家门口划下40天禁航区,释放什么信号?

要动手了?中国在家门口划下40天禁航区,释放什么信号?

像诗一样的姑娘
2026-04-07 12:20:24
张雪录用应届生真相:会骑车的多,懂英语愿出差的少,家长扎心了

张雪录用应届生真相:会骑车的多,懂英语愿出差的少,家长扎心了

教育人看世界
2026-04-07 20:32:48
90年代,陈丽华和好友合影,烫卷发穿裙子,手上戴满了珠宝

90年代,陈丽华和好友合影,烫卷发穿裙子,手上戴满了珠宝

兰亭墨未干
2026-04-07 14:42:42
出轨的女人,你陪男人睡,不是因为你的美,是因为你的天真和廉价

出轨的女人,你陪男人睡,不是因为你的美,是因为你的天真和廉价

加油丁小文
2026-03-25 08:30:09
2026-04-08 07:47:00
每日经济新闻 incentive-icons
每日经济新闻
中国主流财经全媒体平台。
1530894文章数 2725152关注度
往期回顾 全部

科技要闻

满嘴谎言!OpenAI奥特曼黑料大起底

头条要闻

伊朗接受停火提议

头条要闻

伊朗接受停火提议

体育要闻

楚阿梅尼:第二个丢球对我们打击很大;次回合会有人站出来

娱乐要闻

女首富陈丽华离世 被曝生前已分好遗产

财经要闻

10万亿财政转移支付,被谁拿走了?

汽车要闻

不止是大 极狐首款MPV问道V9静态体验

态度原创

健康
游戏
本地
旅游
军事航空

干细胞抗衰4大误区,90%的人都中招

ARPG《堕落之主2》新海报 性感女角大腿吸睛

本地新闻

跟着歌声游安徽,听古村回响

旅游要闻

国内出游总花费613.67亿元!加长版清明假期带火文旅

军事要闻

文化符号当“弹药” 美伊将信息战带入新阶段

无障碍浏览 进入关怀版