![]()
谷歌今日推出了迄今为止最强大的入门级人工智能模型。
Gemini 3.7 Flash 在上一代产品发布仅三周后便正式上线。尽管发布周期较短,谷歌工程师仍实现了输出质量的显著提升。谷歌表示,Gemini 3.7 Flash 在九项基准测试中均超越了来自 Anthropic 和 OpenAI 的同类模型。
其中一项夺得第一名的评测为 FrontierCode 1.1 Main,该基准包含 100 个涵盖多种编程语言的编程任务,不仅要求模型生成可运行的代码,还需满足企业软件项目中常见的其他要求,包括代码在提交前须经过错误测试,并遵循项目特定的代码风格规范。
与上一代相比,Gemini 3.7 Flash 在生成用户界面方面表现尤为突出。谷歌表示,该模型设计的布局与用户上传的参考图像更为贴合。此外,Gemini 3.7 Flash 每次提示最多可处理 100 万个 Token 的图片、视频和文本内容,响应输出最多可包含 64,000 个 Token 的文本。
谷歌产品管理高级总监 Tulsee Doshi 在博客中写道:"Gemini 3.7 Flash 相较于 3.6 Flash,为开发者带来了明显改善的使用体验。它能更好地应对障碍,在必要时澄清意图,并以更高的准确性执行指令。它的思考更加严谨,在多步骤规划和工具调用方面投入了更多精力。"
该模型的应用范围不局限于编程领域。谷歌通过 GDP.pdf 基准对其进行了测试——这是一项要求模型回答商业文档相关问题的评测,Gemini 3.7 Flash 正确回答了 34% 的问题,分别领先 Claude Sonnet 5 和 GPT-5.6 Terra 达 6% 和 9.3%。此外,谷歌表示 Gemini 3.7 Flash 还可用于驱动 AI 智能体集群。
谷歌未透露该模型的具体架构。Gemini 3.7 Flash 的模型说明卡显示,其架构与上一代 Gemini 3.6 Flash 相同,而后者源自 Gemini 3 Pro,该模型采用基于 Transformer 的混合专家架构。
Gemini 3.7 Flash 的模型说明卡中同样未提供训练相关信息。开发者通常会通过蒸馏同系列中更强大模型的输出来训练入门级神经网络。例如,Meta 近期发布的 Muse Glimmer 大语言模型便是通过蒸馏 Muse Spark 得到的。
谷歌将在年底前以 Gemini 3.6 Flash 半价的方式向开发者开放 Gemini 3.7 Flash 的访问权限。此外,谷歌还将把该模型引入 Gemini Spark——这是一款于今年三月推出的面向消费者的 AI 智能体,能够浏览网页并在其他谷歌服务中执行操作。
Q&A
Q1:Gemini 3.7 Flash 和上一代 Gemini 3.6 Flash 相比有哪些提升?
A:Gemini 3.7 Flash 在多项能力上有显著改进:生成用户界面时与参考图像的匹配度更高;在多步骤规划和工具调用上表现更稳定;在 FrontierCode 1.1 Main 等编程基准以及 GDP.pdf 商业文档问答基准中均超越同类竞品。此外,它还支持每次提示处理最多 100 万个 Token,输出最多 64,000 个 Token 的文本内容。
Q2:Gemini 3.7 Flash 的架构是什么?
A:根据谷歌发布的模型说明卡,Gemini 3.7 Flash 采用与 Gemini 3.6 Flash 相同的架构,该架构源自 Gemini 3 Pro,核心为基于 Transformer 的混合专家(Mixture-of-Experts)架构。谷歌未进一步披露该模型的详细架构信息及训练方式。
Q3:Gemini 3.7 Flash 的价格如何?普通用户能用到吗?
A:谷歌表示,在今年年底前,开发者可以以 Gemini 3.6 Flash 半价的价格访问 Gemini 3.7 Flash。对于普通用户,谷歌还将把该模型接入 Gemini Spark——一款面向消费者的 AI 智能体,于今年三月上线,支持网页浏览及在谷歌其他服务中执行操作。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.