8月下旬的国产大模型圈,剧情密度堪比悬疑连续剧:一个叫"Ox Alpha"的匿名模型空降海外榜单掀翻全场,中文社区给它起了个接地气的外号"牛来";六天后谜底揭晓——智谱官宣它就是GLM-5.3-Flash,次日股价高开大涨;同一时间,DeepSeek V4一边涨价、一边终于"睁开眼睛"补上了视觉能力;再往前几天,MiniMax靠新一代视频模型在港股同样赚足涨幅。短短两周,风向似乎悄悄变了:上半年还压着打的DeepSeek,这波热度明显被智谱抢了去。本文就把这盘棋从头捋一遍。
![]()
故事要从8月20日说起。一款名为Ox Alpha的模型悄然登陆OpenRouter平台——没有发布会,没有官方通稿,甚至没有署名,平台仅标注它由第三方团队运营、预览阶段保持匿名。
但它的配置单很快引发了骚动:
- 100万token上下文窗口,支持文本、图像、视频三类输入
- 免费开放推理,官方号称每天可供100万亿token的调用量
- 主打代码编写能力,定位直指Claude Code这类编码智能体场景
![]()
真正点燃社区的是成绩单:Ox Alpha空降编码榜单前列,多项基准表现据称超过Claude Fable 5,甚至有传言碾压GPT-5.6。免费、匿名、霸榜,三个元素凑齐,全球AI社区立刻开启"猜爹"狂欢。因为"Ox"意为"牛",国内网友戏称其为"牛来大模型""牛爹"。更多人则注意到一个规律:这已经是OpenRouter上线的第五个匿名模型,而前四个最终都被证实来自中国团队——猜测名单里,智谱和DeepSeek赫然在列。
按此前匿名模型的节奏,业内普遍预计免费测试会在一周左右结束、官方身份随后揭晓。在悬念发酵的六天里,这个神秘模型烧掉了42万亿token的调用量,并登顶OpenRouter——用真金白银的算力换了一场全球范围的技术路演。
![]()
谜底揭晓:智谱官宣,股价高开大涨
8月26日,智谱揭盅:Ox Alpha就是GLM-5.3-Flash,正式上线并以MIT协议开源。技术底细也随之公开:
- 320B总参数、18B激活参数(320B-A18B),共45层,稀疏激活架构
- GLM-5系列首个原生多模态模型:视觉编码(Visual Coding)不只是"能看图",而是把Coding能力拓展到了前端开发、游戏开发、3D开发这些需要"看懂画面再写代码"的领域
- 首个将稀疏注意力与线性注意力融合进同一架构的开源前沿模型,大幅降低长上下文的服务成本
- 综合能力超过自家上一代旗舰GLM-5.2,Artificial Analysis综合智能指数拿到57分——作为参照,DeepSeek V4 Pro在最大推理模式下是53分
资本市场的反应最为直接:8月27日智谱股价大幅高开,以1115港元开盘,市场情绪一片火热。
这里有个耐人寻味的对照组。就在半个月前的8月14日,智谱发布旗舰GLM-5.3当天,股价反而跌超4%——开发布会、晒跑分,市场不买账;而这次先匿名上线让全球用户盲测出口碑、再官宣认领,股价应声大涨。同一个团队、同一个月,两种发布策略换来截然相反的市场反应,这个反差本身就值得所有To B科技公司反复品味。
![]()
定价掀桌:1/10、1/20,直至Opus的1/40
如果说匿名霸榜是"势",那定价就是"实"。GLM-5.3-Flash的定价策略可以用掀桌来形容:
对比对象
价格比例
GLM-5.3(标准定价)
1/10
GLM-5.3(限时折扣期)
1/20
Claude Opus 4.8
1/40
落到具体数字:标准价为每百万token输入0.8元、输出2.8元;限时折扣期低至输入0.4元、输出1.4元,缓存命中更是只要0.115元。什么概念——百万token一块四毛钱,大概等于一瓶矿泉水的价格,够模型给你产出上万字的内容。智谱官方那句宣传语相当直白:"同样智力,1/40价格,前沿智能,第一次不需要省着用。"
更扎心的是横向对比:Artificial Analysis指数上,GLM-5.3-Flash的57分压过DeepSeek V4 Pro(最大推理)的53分——便宜一个数量级的模型,反而拿了更高的综合分。知乎社区对此的评价是"把大模型的价格卷到了极致"。
配套动作也很齐全:GLM Coding Plan所有套餐同步支持GLM-5.3与GLM-5.3-Flash,体验卡每天限量发放一万张,并且承诺不使用用户提交的Prompt做训练。低价、开源、送体验、保隐私,四张牌一起打。
同一时间的DeepSeek V4:涨价,与睁开眼睛
把镜头转向另一边。DeepSeek的8月其实同样高产,但舆论风头确实被压了下去。
先看时间线:4月24日V4预览版开源(V4-Pro与V4-Flash),7月31日V4-Flash-0731转正,8月13日凌晨V4-Pro-0813正式版上线,8月21日又放出V4-Flash-Vision-Exp视觉实验版。
平心而论,V4 Pro正式版是一份硬核答卷:上下文从128K一口气扩展到1M token,首次引入KV Cache分层设计;DeepSWE得分从预览版的7.3暴涨到62.7,超越Claude Opus 4.8;Agent能力大幅增强,还随版附赠了以MIT协议开源的官方Harness框架("一切皆插件"的智能体基础设施)。发布当晚,DeepSeek确实刷了屏。
但两件事改变了风向。其一是涨价:正式版价格较预览期上调,"能力比肩Opus 4.8,但价格也向Opus看齐了一步"——在全网比价情绪高涨的当口,涨价天然处于舆论下风口。其二是节奏:V4 Pro 8月13日凌晨刚刷完屏,24小时后的8月14日,智谱GLM-5.3贴身跟上,DeepSWE直接打出66.9对62.7的反超,还附赠Terminal-Bench 3.0从4.6到28.3的六倍跃升、CyberGym 84.5%的白盒安全审计成绩(高于Mythos 5的83.8%和GPT-5.6 Sol的83.6%)。钛媒体的对比实测更扎眼:同一个任务,V4-Pro跑了30分钟,GLM-5.3只用了6分半,727行代码一次跑通。
至于8月21日的V4-Flash-Vision-Exp,则是DeepSeek的"睁眼"时刻——V4系列此前一直是纯文本模型,这个实验版本终于支持了图片识别。方向无疑是对的,只是"实验版"三个字放在智谱原生多模态模型正式开源的同一周,对比之下多少有些以卵击石的意味。
为什么说"势头"倒向了智谱:三个关键动作
复盘这半个月,智谱的攻势可以拆成三招:
第一招,匿名盲测先行,让实力自己说话。36氪对此有个精辟观察:这暴露了大模型发布逻辑的变化——下一代模型可能不再先开发布会,而是先匿名上线接受真实环境盲测。用户先用爽了,官宣才有引爆力。Ox Alpha六天42万亿token的调用量,就是全球开发者用脚投票的成绩单,比任何发布会PPT都有说服力。
第二招,价格锚点反向操作。DeepSeek正式版涨价、智谱把价格打到Opus的1/40,一涨一降,舆论势能天然一边倒。"前沿智能不需要省着用"这句话之所以能刷屏,是因为它戳中了所有API重度用户的真实痛点。
第三招,组合拳节奏压制。8月14日GLM-5.3在编程基准上反超V4 Pro,8月26日Flash用多模态+极限低价再补一刀,半个月内两连击,每一击都踩在对手新闻周期的尾巴上。辅以MIT开源、Coding Plan全量接入、每日万张体验卡,热度和转化形成了闭环。
当然也要说句公道话:所谓"压过",压的是声量与叙事,而非全面碾压。
冷静看:DeepSeek V4真的输了吗
答案是没有,远没有。
价格上有个反直觉的事实:单看API定价,DeepSeek V4 Pro其实更便宜——OpenRouter上V4-Pro-0813为输入0.58美元、输出1.74美元每百万token,而GLM-5.3输入就要1.40美元。智谱的"1/40"锚定的是Opus 4.8这个高价靶子,真要论性价比,Flash对的是V4同门。真正拉开差距的是GLM Coding Plan这类订阅制玩法——包月无限量对高频用户的心智杀伤力,远大于按token计价的小数点。
能力版图上各有护城河:V4 Pro在Agent工程闭环上的积累(配合Harness插件化框架)、1M上下文配合KV Cache分层的工程化落地、以及昇腾超节点系列的全面适配——最后这条在国产算力自主的大背景下,分量怎么估都不为过。而知乎横评也承认,前端设计的布局、配色、交互上GLM-5.3确实胜过V4-Pro,但那是和K3一起胜出的。
所以更准确的格局描述是三分天下各有其位:七牛云的选型指南给的建议就很务实——GLM-5.3负责旗舰推理,DeepSeek V4负责Agent工程闭环,GLM-5.3-Flash负责低成本多模态。双雄变三强,受益的是所有开发者。
别忘了第三极:MiniMax视频模型也大涨
这一波行情里还有个不能忽略的角色。7月31日MiniMax发布开源全模态模型H3:视频编辑能力登顶全球第一,视频生成定价仅0.8元/秒(2K分辨率),约为业内旗舰的三分之一,靠高压缩Tokenizer把"生成视频"推向"商业级生产"。当日MiniMax港股开盘涨超20%、收涨13%以上;8月5日又因纳入港股通标的再涨10.25%,高盛、美银、花旗齐给买入评级。
放到8月底回看,港股AI板块已经形成了联动效应:智谱、MiniMax、华虹宏力多次同日领涨。"发布重磅模型→股价大涨"这条传导链在2026年下半年被反复验证,这也解释了为什么各家发布节奏越来越激进——技术发布和资本叙事,早就是一场仗的两个战场。
开发者小结:这波热点里能捡到的实惠
看热闹之余,这一波其实给普通开发者留了不少真金白银的实惠:
- 白嫖旗舰能力:GLM-5.3-Flash体验卡每天限量一万张,OpenRouter上匿名期更是直接免费——多模态+1M上下文+57分的综合智能,先把额度用起来再说
- API成本打骨折:限时折扣0.4元/百万输入token,个人开发者做副业项目、批量数据处理、RAG知识库,成本敏感度直接降了一个数量级
- 订阅党看Coding Plan:GLM Coding Plan已全量支持GLM-5.3与Flash,配合Claude Code、ZCode等编码工具食用效果更佳
- V4用户不必叛逃:重Agent工程闭环、超长上下文批处理、昇腾环境部署的场景,V4 Pro依然是稳妥选择;V4-Flash-Vision-Exp也可以顺手尝尝鲜
- 通用建议:两家都开源,拿自己项目的真实任务各跑一轮,比看十篇评测都靠谱
8月这轮行情,表面是智谱靠一个"牛来"的悬念剧抢走了DeepSeek的风头,实质上演示了大模型竞争进入下半场后的三个新规律:发布逻辑从"发布会宣读"转向"匿名盲测引爆";价格战场从旗舰对标转向普惠掀桌;技术叙事与资本叙事深度捆绑——智谱用股价大涨证明了自己对这三条规律的运用炉火纯青。
但势头不等于终局。DeepSeek V4手里还握着Agent工程闭环、1M上下文工程化和国产算力适配这些硬牌,MiniMax在视频赛道自成一极,Kimi K3的3万亿参数基座也还在蓄力。对开发者来说,最好的策略从来不是站队,而是把每个模型的"当周特价"都变成自己的生产力——毕竟在2026年,顶级AI能力的价格曲线,下行速度比所有人的预期都快。
下一程的看点已经写在了日历上:智谱会不会把这套后训练Scaling方法论复用到下一代基座?DeepSeek的V4.x迭代和Harness生态能否扳回一城?答案不会太久,这个行业现在的更新节奏,是以周为单位的。
本文为 JeecgBoot AI 专题研究系列文章。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.