机器之心编辑部
顶不住,服务器真的顶不住,DeepSeek 要涨价了。
![]()
周四上午,用 DeepSeek API 的同学们都注意到了这样一条公告。DeepSeek 要涨价了,而且预期涨幅会很大。虽然这次官方并未透露具体幅度和生效时间,但已经建议企业与开发者「合理规划请求量、控制充值金额」。
AI 开发者社区里顿时炸开了锅。
长期以来,DeepSeek 凭借超高的 Token 性价比(极低的输入、输出费用,外加很高的缓存命中率)吸纳了庞大的流量,但与此同时,它也面临着的算力成本压力。随着模型调用量呈指数级暴增,补贴式的低价策略似乎难以为继了。
在上周 DeepSeek V4 Flash 0731 发布以后,大模型拥有了接近于 Opus 4.8 的能力,但同时只有 Fable 5 百分之一的价格。这样的成本,在处理高并发、日常对话、代码辅助与高吞吐检索任务时可以说占尽了优势,很多开发者都在尽情使用。
这个上下文长达 1M,速度还很快的模型几乎「用到就是赚到」,什么活都可以交给它去干,没有任何心理负担。
于是终于再现了去年 DeepSeek R1 时的盛况:本周二,不少开发者反映 DeepSeek V4 Flash API 频繁出现 Server Busy、延迟飙升或短暂停机(Downtime)的情况。就连 APP 端也出现了宕机的情况。
![]()
开源的 AI 编程智能体工具 OpenCode 因为套餐里有 DeepSeek 新模型涌进了大量用户,8 月 5 日 V4 Flash 的 token 消耗量已经到了 6.3 万亿。
![]()
有关 V4 Flash 0731 的评测已经很多了,像独立 AI 评测平台 Artificial Analysis Intelligence 就更新了一下他们的综合能力图,把知名模型的价格与智力水平都放在一起对比。V4 Flash 0731 在左上的位置:智能水平高,且价格低。
它框出来的右下的那么多模型,都有着落后的危险。
![]()
而且现在这还只是个 Flash 版,Pro 版出来预计还会继续缩圈。
如此看来,DeepSeek 似乎确实有涨价的理由。
其实在上个月,DeepSeek 已经预告采取峰谷定价机制,北京时间每日 9:00-12:00、14:00-18:00 高峰期调用价格翻倍。官方可能希望以此引导流量错峰,但这种方式看来依然难以全面平衡服务成本与负载压力,毕竟 V4 Flash 0731 出来以后全球都在用,24 小时都是高峰期。
当然这波涨价预告可能也是新版本发布的一部分。DeepSeek 官方预计于 8 月上旬全面上线 DeepSeek-V4-Pro 的 API 部署。作为拥有 1.6T 深度 MoE 架构(激活参数约 49B)的旗舰模型,Pro 版本在长文本(1M Context)、复杂智能体任务和硬核编程上具备极强实力。
与此同时,围绕 V4 系列模型,官方配套的 DeepSeek Harness 生态也很有可能同时推出。开发者可以通过更精细的 Harness 框架(包含 MCP 服务器、Agent 执行环境及多层 Reasoning Effort 调度),将 V4 Pro 的 Agent 潜能最大化。
虽然 API 涨价在即,但对于需要高性价比大模型、复杂代码生成和 Agent 工作的开发者而言,正式版的 V4 Pro 以及大幅增强的 Flash-0731 依然是开源与商业大模型阵营中极为关键的竞争力量。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.