网易首页 > 网易号 > 正文 申请入驻

刚刚,智谱一口气免费开源6款模型,200 tokens/秒成商用速度之最

0
分享至

金磊 发自 凹非寺
量子位 | 公众号 QbitAI

就在刚刚,智谱一口气上线并开源了三大类最新的GLM模型:

  • 沉思模型GLM-Z1-Rumination
  • 推理模型GLM-Z1-Air
  • 基座模型GLM-4-Air-0414

若是以模型大小(9B和32B)来划分,更是可以细分为六款

首先是两个9B大小的模型:

  • GLM-4-9B-0414:主攻对话,序列长度介于32K到128K之间
  • GLM-Z1-9B-0414:主攻推理,序列长度介于32K到128K之间

还有四个32B大小的模型,它们分别是:

  • GLM-4-32B-Base-0414:基座模型,序列长度介于32K到128K之间
  • GLM-4-32B-0414:主攻对话,序列长度介于32K到128K之间
  • GLM-Z1-32B-0414:主攻推理,序列长度介于32K到128K之间
  • GLM-Z1-32B-Rumination-0414:主攻推理,序列长度为128K

而随着一系列模型的开源,智谱也解锁了一项行业之最——

推理模型GLM-Z1-32B-0414做到了性能与DeepSeek-R1等顶尖模型相媲美的同时,实测推理速度可达200 tokens/秒

如此速度,已然是目前国内商业模型中速度最快,而且它的高性价比版本价格也仅为DeepSeek-R1的1/30

值得一提的是,本次开源的所有模型均采用宽松的MIT许可协议。

这就意味着上述的所有模型都可以免费用于商业用途、自由分发,为开发者提供了极大的使用和开发自由度。

那么这些开源模型的效果又如何?

(PS:文末有彩蛋~)

先看性能

首先来看下GLM-4-32B-0414

它是一款拥有320亿参数的基座大模型,其性能足以比肩国内外规模更大的主流模型。

据了解,这个模型基于15T高质量数据进行预训练,其中特别融入了大量推理类合成数据,为后续强化学习扩展提供了坚实基础。

在后训练阶段,智谱团队不仅完成了对话场景的人类偏好对齐,还运用拒绝采样和强化学习等先进技术,重点提升了模型在指令理解、工程代码生成、函数调用等关键任务上的能力,从而显著增强了智能体执行任务的核心素质。

实际测试表明,GLM-4-32B-0414在工程代码编写、Artifacts生成、函数调用、搜索问答及报告撰写等多个应用场景均展现出色表现。

部分基准测试指标已达到或超越 GPT-4o、DeepSeek-V3-0324(671B)等更大规模模型的水平。

从实测效果来看,GLM-4-32B-0414进一步提升了代码生成能力,可处理并生成结构更复杂的单文件代码。

例如来上这么一段Prompt:

  • 用HTML模拟太阳系的行星运动。

再如:

  • 设计一个支持自定义函数绘制的绘图板,可以添加和删除自定义函数,并为函数指定颜色。

以及设计一个小游戏也是不在话下:

  • 用HTML网页实现2048小游戏。

再来看下GLM-Z1-32B-0414的性能,一款专为深度推理优化的模型。

这个模型在GLM-4-32B-0414的基础上,采用了冷启动结合扩展强化学习的策略,并针对数学推导、代码生成、逻辑推理等高难度任务进行了专项优化,显著提升了复杂问题的解决能力。

此外,它还通过引入基于对战排序反馈的通用强化学习(RLHF),模型的泛化能力得到进一步强化。

尽管仅拥有32B参数,GLM-Z1-32B-0414在部分任务上的表现已可媲美 671B 参数的DeepSeek-R1。

在AIME 24/25、LiveCodeBench、GPQA等权威基准测试中,该模型展现出卓越的数理推理能力,能够高效应对更广泛、更具挑战性的复杂任务。

接下来,是更小规模的GLM-Z1-9B-0414,在技术上是沿用了上述模型的方法。

虽然只有9B大小,但它在数学推理及通用任务上展现出超越参数规模的卓越性能,综合表现稳居同量级开源模型前列。

尤其值得关注的是,在资源受限的应用场景中,该模型能够高效平衡计算效率与推理质量,为轻量化AI部署提供了极具竞争力的解决方案。

最后,再来看下沉思模型GLM-Z1-Rumination-32B-0414

这个模型可以说是智谱对AGI未来形态的一个探索。

沉思模型采用与传统推理模型截然不同的工作范式,通过多步深度思考机制有效应对高度开放性和复杂性问题。

其核心突破体现在三个方面:

  1. 在深度推理过程中智能调用搜索工具处理复杂子任务;
  2. 创新性地引入多维度规则奖励体系,实现端到端强化学习的精准引导与扩展;
  3. 完整支持”问题发现→信息检索→逻辑分析→任务解决”的研究闭环系统。

这些技术创新使该模型在学术写作、深度研究等需要复杂认知能力的任务上展现出显著优势。

例如让它回答一个科学假设推演问题:

  • 如果人类在火星地下发现液态湖泊中存在类似地球古菌的微生物,请推测:
    (1) 这些微生物可能如何适应极端环境?(2) 这一发现对‘生命起源泛种论’的支持/反驳证据有哪些?(3) 设计一个可验证这些假说的空间实验方案(预算限制5亿美元)。
再看价格

除模型开源外,基座、推理两类模型也已同步上线智谱MaaS开放平台(bigmodel.cn),面向企业与开发者提供API服务。

本次上线的基座模型提供两个版本:GLM-4-Air-250414和GLM-4-Flash-250414,其中GLM-4-Flash-250414完全免费。

上线的推理模型分为三个版本,分别满足不同场景需求:

  • GLM-Z1-AirX(极速版):定位国内最快推理模型,推理速度可达 200 tokens/秒,比常规快 8 倍;
  • GLM-Z1-Air(高性价比版):价格仅为 DeepSeek-R1 的 1/30,适合高频调用场景;
  • GLM-Z1-Flash(免费版):支持免费使用,旨在进一步降低模型使用门槛。

为了更加一目了然,价格表如下:

至于配置方面,32B基础模型、32B推理模型、32B沉思模型(裸模型)的要求如下:

  • 1张H100 / A100或者更先进的NVIDIA旗舰显卡
  • 4张4090/5090/3090
One More Thing

除了上述内容之外,智谱这次还有一个亮点的动作——

拿下一个顶级域名Z.ai!

目前已经上线了下面三款模型:

而且官方还亮出了一个比较有意思的slogan:

最后,纵观智谱在大模型时代的发展,不得不感慨其更新迭代以及开源的速度。

这样难怪它能成为第一家正式启动IPO流程的“大模型六小龙”。

体验地址:
z.ai

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
出售公民信息千元一条,国家反诈平台成内鬼摇钱树

出售公民信息千元一条,国家反诈平台成内鬼摇钱树

高恒说
2026-05-10 16:58:40
世界级港口被20国争抢,美国直接叫价千亿!可投资方却只认准中国

世界级港口被20国争抢,美国直接叫价千亿!可投资方却只认准中国

大运河时空
2026-05-06 13:00:03
连中国都看懵了!特朗普访华前夕,高市早苗砸万亿对美下狠手!

连中国都看懵了!特朗普访华前夕,高市早苗砸万亿对美下狠手!

丁丁鲤史纪
2026-05-11 15:49:27
问就是运气!网友1.1万拿下3.5万神机:顶配M4 Max MacBook Pro+4TB硬盘

问就是运气!网友1.1万拿下3.5万神机:顶配M4 Max MacBook Pro+4TB硬盘

快科技
2026-05-11 12:41:10
“华为”改为“国内通信设备商”,中天科技撤回投资者关系活动记录表?

“华为”改为“国内通信设备商”,中天科技撤回投资者关系活动记录表?

北京商报
2026-05-11 20:48:14
俄加强对普京的保护措施,欧洲情报机构猜测,可能与绍伊古有关

俄加强对普京的保护措施,欧洲情报机构猜测,可能与绍伊古有关

梦史
2026-05-11 03:52:03
颠覆认知!最新研究:每周一次性生活,男性癌症风险降低69%?

颠覆认知!最新研究:每周一次性生活,男性癌症风险降低69%?

果壳
2026-05-11 15:39:46
王彩桦挨轰「整得像鬼」泪崩!退通告内幕曝光 小S暖心力挺:你很美

王彩桦挨轰「整得像鬼」泪崩!退通告内幕曝光 小S暖心力挺:你很美

ETtoday星光云
2026-05-11 14:51:12
奔驰撞人后续:遇难者是母女,目击者曝司机技术差,挪车也要指挥

奔驰撞人后续:遇难者是母女,目击者曝司机技术差,挪车也要指挥

萧嚉影视解说
2026-05-11 14:46:34
宣告奇迹出现不到1个月,蔡磊近况曝光,他已为自己安排好后路

宣告奇迹出现不到1个月,蔡磊近况曝光,他已为自己安排好后路

一盅情怀
2026-05-11 09:26:17
1个月内被开5次罚单+警告函!这支CBA球队成“反面”教材

1个月内被开5次罚单+警告函!这支CBA球队成“反面”教材

狼叔评论
2026-05-11 22:38:13
OPPO母亲节文案翻车,原来是武大余思月写的

OPPO母亲节文案翻车,原来是武大余思月写的

大张的自留地
2026-05-11 09:32:12
Kanye妻子穿透视装引争议,此前哥大评审却裹得严实

Kanye妻子穿透视装引争议,此前哥大评审却裹得严实

娱圈观察员
2026-05-11 20:13:04
人伦之乱,正在悄悄毁掉无数家庭!看完一身冷汗

人伦之乱,正在悄悄毁掉无数家庭!看完一身冷汗

三农老历
2026-05-08 19:20:12
让无数人后悔的手术!有严重后遗症,很多做完都后悔了,术前注意

让无数人后悔的手术!有严重后遗症,很多做完都后悔了,术前注意

芹姐说生活
2026-05-11 13:39:32
纳斯达克中国金龙指数涨幅扩大,现涨1.0%,最新报7065.8点

纳斯达克中国金龙指数涨幅扩大,现涨1.0%,最新报7065.8点

每日经济新闻
2026-05-11 22:03:41
巴拿马朝中国递橄榄枝!反差之大,仿佛上演了一场“变脸”戏

巴拿马朝中国递橄榄枝!反差之大,仿佛上演了一场“变脸”戏

回京历史梦
2026-05-11 19:15:21
特朗普访华名单确定,国务卿鲁比奥也在其中,欲拿台湾问题做筹码

特朗普访华名单确定,国务卿鲁比奥也在其中,欲拿台湾问题做筹码

聚焦瞬间
2026-05-10 13:47:15
比TNT廉价,比石油致命:白糖凭什么成为人类文明最危险战略物资

比TNT廉价,比石油致命:白糖凭什么成为人类文明最危险战略物资

丁丁鲤史纪
2026-05-05 10:33:14
为了冲10%增长,越南赌场KTV全面松绑

为了冲10%增长,越南赌场KTV全面松绑

凤眼论
2026-05-10 22:14:23
2026-05-11 23:32:49
量子位 incentive-icons
量子位
追踪人工智能动态
12605文章数 176461关注度
往期回顾 全部

科技要闻

黄仁勋:你们赶上了一代人一次的大机会

头条要闻

重庆一57岁女医生驾奔驰酿车祸 操作不当致2死6伤

头条要闻

重庆一57岁女医生驾奔驰酿车祸 操作不当致2死6伤

体育要闻

梁靖崑:可能是最后一届了,想让大家记住这个我

娱乐要闻

“孕妇坠崖案”王暖暖称被霸凌协商解约

财经要闻

宗馥莉罢免销售负责人 部分业务将外包

汽车要闻

吉利银河“TT”申报图曝光 电动尾翼+激光雷达

态度原创

时尚
数码
亲子
房产
军事航空

2026年了,最好看的还是这件上衣

数码要闻

追觅推出Y-Wind31系列空调:送风距离7.2m、APF5.26能效

亲子要闻

亚太生殖年会重磅发布LILY研究 科学循证守护母婴安全

房产要闻

产业赋能教育!翰林府与北师大的这场签约,绝不那么简单!

军事要闻

特朗普:伊朗的回应“完全不可接受”

无障碍浏览 进入关怀版