![]()
8月20日,一款名为Ox Alpha的匿名大模型在第三方供应商平台OpenRouter悄然上线。这个大模型能力强悍,甚至能对标美国最先进的闭源大模型,而且声称每日可提供高达100万亿Token的服务容量,算力资源惊人。这个大模型上线后迅速引发开发者社区和AI观察者关注,因为Ox的英文含义是“牛”,引起很多网友调侃。人们都在猜测Ox Alpha大模型的来源,甚至多个谷歌员工暗示是谷歌的新模型。8月26日晚谜底揭开,Ox Alpha大模型是中国AI公司智谱的新产品GLM-5.3-Flash,而且巨量算力全部由国产芯片完成,硬件效率和单token成本已达到与主流英伟达GPU相当的水平,“证明国产芯片完全可以在大规模场景下高效、经济地支撑前沿模型的推理需求”。
Ox Alpha是在8月20日突然上线第三方供应商平台的,据介绍,它是一款面向编程、长时程智能体任务及生产工作负载的推理优先模型。它支持约100万上下文窗口,支持文本、图像和视频等多模态,免费体验一周,声称每天可提供100万亿Token的服务容量。
开发者社区测试显示,Ox Alpha的能力比肩Claude Opus 4.8等最新大模型。
![]()
Ox大模型高达DeepSeek的霸榜纪录。
更让人们感到印象深刻的是其巨大的算力,目前全球AI推理每天总token量估计约为300–400万亿,谷歌全平台每天大约为100万亿。单个公司或单个模型能稳定提供每天100万亿的免费token,意味着它能支撑全球相当大一部分AI公开流量,相当于“一个小型国家的AI使用量”。这么巨大的算力,可能需要数万至数十万张算力卡,满负荷运行一天电费可能就要100万–200万美元。
Ox Alpha上线后,使用量迅速攀升,超过DeepSeek一倍以上,终结DeepSeek连续56天的霸榜纪录。
它的身份之谜引发全网猜谜,虽然一些开发者通过多种“指纹”分析,认为Ox Alpha是智谱的GLM系列,但很多人都不相信智谱或者中国AI公司拥有这么大的算力。多位谷歌员工甚至暗示,它是谷歌的最新大模型。
![]()
智谱认领Ox大模型前,谷歌员工曾暗示是其家产品
8月26日晚,智谱公开认领了Ox Alpha,确认其为GLM系列新版本GLM-5.3-Flash,并已开源。该模型为GLM-5系列首个原生多模态版本,定价为GLM-5.3的十分之一,限时折扣为二十分之一。开发者比较发现,这个大模型的价格甚至已经低于DeepSeek。
智谱表示,这是该公司首次在大规模流量中尝试用国产芯片集群提供服务。据公开报道,这批芯片调用超过10万张,供应商或来自华为、摩尔线程与海光等公司。在开发过程中,还利用GLM-5.3大模型大大加速,形成“模型优化系统,系统承载模型”的正向循环。经过努力,在国产加速芯片上实现了高效、可靠的服务,硬件效率和单token成本已达到与主流英伟达GPU相当的水平。这证明国产芯片完全可以在大规模场景下高效、经济地支撑前沿模型的推理需求。扬子晚报/紫牛新闻记者 宋世锋
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.