这个夏天,全球AI行业最热闹的事,不再是发新模型、比跑分,而是——发钱。
从硅谷到北京,一场围绕Token(AI模型的计算计价单位)的补贴大战正在白热化。OpenAI、Anthropic、DeepSeek、小米等巨头轮番降价,幅度动辄八成、九成甚至99%,被业内戏称为“Token奶茶大战”——免费额度多到像买一送一的奶茶券,各家都在拼命往你手里塞。
砍价砍到脚踝:降价潮一波接一波
北京时间7月31日,OpenAI放出重磅消息:GPT-5.6系列的入门级模型Luna,API输入和输出价格统一下调80%,每百万Token分别降至0.2美元和1.2美元;另一款模型Terra同步降价20%。OpenAI在官方博文中称,普及先进智能是公司的核心使命,希望通过降价让用户在AI方面的每一分投资都“物有所值”。
![]()
这并非孤例。早在今年5月,DeepSeek和小米就率先掀桌子——小米MiMo-V2.5系列最高降价99%,且不再区分上下文长度;同一天,DeepSeek宣布V4 Pro永久降价,最高降幅同样达到99%。此前阿里云、百度智能云等国内厂商也纷纷祭出免费或近乎免费的策略,大模型API从“按字收费”一路卷到了“白菜价”。
从“发券”到“送钱”:免费额度多到用不完
更夸张的是,AI厂商不满足于单纯降价,开始直接“送Token”。
据媒体报道,今年5月前后,OpenAI曾向YC系创业公司提出,每家公司最高可获200万美元等值的Token,条件是要拿出部分股权。AI客服平台Pylon的CEO向《华尔街日报》透露,今年以来公司从一家模型供应商处获得了约160万美元的免费Token,另外两家供应商各自送出了数万美元额度,甚至还有厂商提供了数月无限量免费使用权。
![]()
![]()
Anthropic这边也不甘示弱。其顶级模型Claude Fable 5自6月9日发布以来,免费推广期一延再延——从原定7月7日截止,先延到7月12日,最终覆盖到7月19日。直到7月20日,Fable 5才正式被纳入高阶套餐,免费额度缩至每周用量限制的50%。
要知道,Fable 5的定价可不便宜——每百万输入Token高达10美元,输出Token更是50美元——免费送的每一分钱都是真金白银。
羊毛出在羊身上?厂商打的什么算盘
AI公司又不是慈善机构,如此烧钱图什么?
答案藏在用户数据里。OpenAI旗下的编程助手Codex,截至6月初每周活跃用户已超过500万,是今年2月桌面应用推出时的6倍以上。更让人意外的是,非开发者用户占比约20%,增速是开发者的3倍多。到今年5月,超过80%的Codex个人用户曾提交过相当于人类工作30分钟以上的复杂任务,四分之一的用户提交过相当于8小时以上的任务量。
![]()
Anthropic方面同样亮眼:截至今年2月,Claude Code的年化收入已超过25亿美元,企业订阅数量增长4倍,企业客户贡献了超一半收入。对约40万次Claude Code会话的分析显示,用户平均每周使用约20小时,写文档和分析数据的任务占比从2025年10月到2026年4月翻了一倍,平均任务价值提高了27%。
说白了,厂商们不是在“撒钱”,而是在“养用户”——先用免费和低价把开发者和企业拉进场,等大家习惯用AI干活了,再慢慢谈变现。
数十亿Token狂欢背后:行业面临定价重构
这场Token补贴大战的影响远超想象。有研究机构数据显示,截至2026年3月,中国日均Token调用量已突破140万亿,相比2024年初增长了1000多倍。
![]()
但烧钱总有尽头。也有分析指出,AI智能体的普及带来了海量Token消耗,正在击穿原有的成本防线。2025年下半年起,部分厂商已开始收缩免费额度,甚至上调价格,涨幅最高超过400%。行业正在从“流量补贴”转向“价值筛选”,低价竞争能否持续,取决于厂商的工程能力和规模效应。
一个不争的事实是:Token就是新时代的算力货币。谁能用更低成本让用户“用得起、用得爽”,谁就能在这场智能时代的奶茶大战中抢到最大的蛋糕。而眼下,巨头们的补贴金还在源源不断地往外掏——这场仗,远没到结束的时候。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.