Google今日正式发布Gemini 3.7 Flash,延续该公司加快发布节奏的路线,更是在下一代模型发布前便再次带来重大更新。新模型的诞生直接基于开发者反馈与算法优化,相关成果也将在未来继续融入旗舰模型中。Gemini 3.7 Flash 在软件工程、网页开发以及知识工作领域实现了“显著提升”。
在编程领域,新模型相比 3.6 Flash 在调试与问题解决方面取得了强劲增长。具体来看,DeepSWE v1.1 评估得分从此前的 49.0% 跃升至 65.3%,在 FrontierCode 1.1 Main 测试中的表现也由 34.4% 提升至 43.6%。
在网页开发方面,Gemini 3.7 Flash 能以更少的提示词生成功能更完整的布局和应用。在 Arena.ai 的 WebDev Arena 评估中,上一代模型的 Elo 得分为 1538 分,而本次新模型达到了 1588 分。无论输入参考是草图、图片还是完整的系统设计,新模型在 UI 生成中都展现出了更高的设计契合度与一致性。
针对金融、法律、生物科学等知识密集型领域,新模型的推理准确度同样获得突破。在测试复杂文档处理能力的 GDP.pdf 基准测试中,Gemini 3.7 Flash 以 34.0% 对 22.0% 的成绩大幅超越 3.6 Flash;在评估实际业务流程执行能力的 AutomationBench 测试中,新模型也以 30.4% 的成绩领先上一代的 17.0%。
开发者将体验到更具适应性的 Gemini 3.7 Flash,它在面对挫折时能更好地做出调整,必要时可主动澄清目标,并以更高的置信度遵循指令。新模型在复杂步骤规划和工具调用中展现出更严谨的推理能力,这种更具纪律性的执行意味着更少的人工监督,从而大幅降低工程工作流中的验证成本。
安全防护方面,新模型更新了针对化学、生物、放射性物质与核(CBRN)以及网络攻击领域的防滥用机制,并在符合生物安全方法论和网络安全计划的框架下,进一步赋能负责任的应用场景。
价格方面,截至 2026 年底,Gemini 3.7 Flash 的定价为输入每百万 Token 0.75 美元、输出每百万 Token 3.75 美元,仅为下一代模型发布时价格的一部分。
目前在 Gemini 应用中,3.7 Flash 已面向 Spark 用户推出(订阅 AI Pro 或 Ultra 的用户也将获得)。模型的落地将使得个人智能体在知识工作领域发挥更大作用,并改善针对 Google Workspace 应用的工具使用能力。此外,该模型也已陆续集成到 Google Antigravity、AI Studio、Android Studio、Gemini Enterprise Agent Platform 以及 Gemini Enterprise 应用。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.