谷歌在六周内发布了第三款Flash系列模型——Gemini 3.8 Flash。这款新模型在部分智能体编码基准测试中追平了Claude Opus 5,但成本更低。不过,一个细节值得注意:它比前代更“烧钱”。
“更努力”的代价
![]()
据The Decoder报道,Gemini 3.8 Flash的推理机制是“更努力地工作”,这导致它每处理一个任务,输出的token数量比前代多出约30%。尽管官方标称的token费率与前代完全一致,但实际使用中,用户为每个任务支付的费用反而更高了。
换句话说,单看单价没变,但干同样的活,它消耗的“字数”更多,总账单自然就上去了。这种策略在基准测试上好看,但真实项目里的成本控制,可能得重新算一笔账。
平价连发,旗舰缺席
更让市场好奇的是谷歌的节奏:六周内连续推出三款Flash系列平价模型,而真正的旗舰级前沿模型却迟迟没有动静。这种“以量换价”的打法,在当下竞争激烈的AI市场里,显得格外扎眼。
一边是平价模型快速迭代抢占市场,另一边是旗舰产品持续“跳票”。谷歌的算盘到底怎么打的,目前还看不清楚。但至少对开发者来说,多一个低价选项总归是好事——前提是,你得先算清楚那30%的额外token成本。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.