![]()
7月31日这天,全球AI圈接连爆出两条重磅消息,恰好勾勒出当下大模型行业最真实的竞争图景:国内DeepSeek悄无声息上线V4-Flash正式版API开启公测,轻量模型凭借迭代优化实现智能体能力跨越式提升;另一边OpenAI紧急下调GPT-5.6系列价格,Luna版本降幅高达80%,中端Terra下调两成,上市仅三周就大幅让利用户。
![]()
![]()
曾几何时,海外闭源大模型牢牢把控技术与定价话语权,国产模型只能靠着低价抢占下沉市场。但短短半年风向彻底扭转:国产厂商一边不断压低调用成本,一边猛攻代码、智能体自主执行核心能力,倒逼行业龙头放下身段卷入价格厮杀。如今业内早已达成共识:低廉的调用费用只能帮开发者拿到入局AI赛道的资格,真正决定一款模型生命力、能落地创造价值的,是实打实的Agent智能体干活能力。
一、低调迭代上线:小体量模型交出越级智能成绩单
DeepSeek此次更新没有举办大型发布会,仅通过官方文档更新日志官宣V4-Flash正式版公测,距离4月份V4系列预览版发布刚好过去三个月。不少开发者起初以为,Flash版本只是旗舰Pro版的缩水低配款,主打低延迟、低成本,性能会天然逊色一截,可本次后训练优化彻底打破了固有认知。
这款模型沿用MoE稀疏架构,总参数284B,日常激活参数仅13B,模型整体结构、参数规模和此前预览版完全一致,研发团队没有堆砌算力、扩充参数,仅仅依靠一轮深度后训练微调,就让整体智能水平迎来质变。最亮眼的突破集中在Agent全场景能力,九项权威行业基准测试分数,全部超越三个月前发布的V4-Pro预览版:TerminalBench2.1斩获82.7分、代码仓库转换NL2Repo54.2分、网络安全场景Cybergym76.7分,无论是终端指令执行、全栈代码开发,还是工具自主调用、自动化办公任务,表现都全方位升级。
除此之外,两大实用功能极大拓宽了落地边界。模型支持思考、非思考两种模式自由切换,简单日常对话关闭思考链路,既能节省token消耗、加快响应速度,复杂科研、编程难题开启思考模式,深度推演保障答案准确率;最长100万token超大上下文窗口依旧保留,并且完成了效率革新,同等超长文本场景下,推理计算量只有前代V3.2版本的27%,显存占用的KV缓存更是降至原先10%,超长文档梳理、大型代码库通读这类重负载任务,算力开销大幅缩减。
![]()
生态适配层面也充分照顾开发者迁移需求,原生兼容OpenAIResponsesAPI标准格式,完整适配Codex代码体系,开发者无需修改底层接口地址,就能无缝从海外模型切换过来。此前预览版已经适配ClaudeCode、OpenCode等市面上绝大多数AI编程智能体产品,正式版上线后,各类代码助手、自动化办公工具接入门槛被进一步压低。
二、分层定价极致亲民,国产性价比倒逼巨头降价
在定价策略上,DeepSeek依旧延续了普惠路线,两个版本阶梯定价清晰,适配不同体量开发者需求。
旗舰V4-Pro将于8月初正式上线,缓存命中输入1元/百万tokens,未命中缓存输入12元/百万tokens,输出内容24元/百万tokens,主打顶尖性能,对标GPT、Claude顶级闭源模型;而经过能力升级的V4-Flash定价格外亲民,缓存命中输入仅0.2元/百万tokens,未命中输入1元/百万tokens,输出2元/百万tokens,高频调用、批量自动化任务使用成本极低。
![]()
低廉的价格搭配越级的智能能力,直接给海外头部厂商带来巨大竞争压力。就在DeepSeek官宣新版本的同一天,OpenAI仓促发布降价通知:刚推出三周的GPT-5.6Luna直降80%,中端Terra下调20%,只有顶配旗舰Sol价格纹丝不动。官方对外解释是模型自主优化推理效率、降低了生产成本,但业内普遍认为,国产大模型持续冲击中低端API市场,客户不断流失,才是被迫降价的核心原因。
前两年AI行业野蛮扩张阶段,企业开发者不在乎调用开销,一味追求最强模型性能;如今AI落地进入精细化运营周期,绝大多数中小企业、初创团队预算收紧,既要控制成本,又需要稳定可用的智能能力。一边是价格居高不下的海外闭源模型,一边是低价且能力持续追赶的国产模型,用户流向早已发生倾斜,OpenAI不得不通过降价守住基础用户盘。
三、告别低价内卷:Agent才是拉开差距的核心赛道
过去一年,大模型行业充斥着无休止的价格战,各家比拼谁的token调用价格更低,不少小厂商甚至以亏本定价抢占流量。但厮杀到当下,所有人都看清了一个现实:单纯比拼价格没有长远意义,低价只能吸引用户初次接入,想要留住开发者、实现商业化落地,最终比拼的是AI自主完成复杂任务的Agent能力。
所谓Agent智能体,通俗来讲就是让AI摆脱单轮问答局限,可以自主看懂需求、调用工具、分步执行任务、修正过程错误,独立完成搭建项目、编写整套程序、批量处理办公流程这类长周期复杂工作,这也是未来AI赋能各行各业的核心基础。此前很长一段时间,海外Claude、OpenAI凭借积累,在长周期智能体任务上保有领先优势,但国产模型追赶速度远超预期。
DeepSeekV4系列便是典型代表,Pro预览版内部评测显示,非思考模式交付质量已经接近ClaudeOpus4.6,数学、理工科竞赛、高难度代码编写能力,对标GPT-5.4、Opus4.6-Max等全球顶级闭源模型;本次Flash轻量版更进一步,用更低的调用成本,把日常编程、自动化办公、工具调用这类高频Agent场景打磨得更加成熟,印证了“低价不等于低能”的行业新逻辑。
放眼整个行业,国内一众头部大模型都在同步发力智能体赛道:有的深耕办公自动化场景,打通各类协作软件;有的聚焦代码开发智能体,适配程序员全工作链路;还有的瞄准操作系统全域操控,不断缩小和海外顶尖模型的差距。价格内卷的红利早已见底,现在比拼的是谁能让AI真正成为可干活、高效率的数字助手。
如今全球大模型行业已经走完了比拼参数、比拼价格的初级阶段。低廉的API调用费用,仅仅是创业者和企业踏入AI时代的入门入场券;而成熟稳定、可落地交付的Agent智能能力,才是决定各大厂商能否走到决赛圈的核心底气。
DeepSeek本次新版本迭代,以及OpenAI被迫大幅降价的连锁反应,正是行业拐点最直观的缩影:国产大模型不再单纯依靠性价比生存,而是靠着技术打磨补齐核心短板,一步步重塑全球AI市场格局。未来一段时间,价格波动会慢慢趋于平稳,围绕智能体落地场景的深度比拼,才会成为贯穿行业发展的主旋律。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.