来源:市场资讯
(来源:优刻得云计算)
优刻得一站式AI开发平台星图AstraFlow上新GLM-5.3-Flash,这是GLM-5系列的首个原生多模态模型。
GLM-5.3-Flash总参数320B,能力超过GLM-5.2,在全球权威的Artificial Analysis Intelligence Index(AA综合智能指数)中取得57分,进入全球前沿模型能力区间,与Anthropic最受欢迎的模型Claude Opus 4.8得分持平。在自研Z.ai Code Bench体感评估中,其编程表现与Claude Opus 4.8相当。
![]()
与此同时,GLM-5.3-Flash定价为GLM-5.3的1/10,为Opus 4.8的1/40。
![]()
GLM-5.3-Flash在各项基准测试和实际使用中,全面超越参数量高出一倍的GLM-5.2,定价仅为后者的1/10。这得益于其全新模型架构。GLM-5.3-Flash的架构专为极低成本而设计,总参数量与GLM-4.5相当(355B vs. 320B),但激活参数量(32B → 18B)与层数(92 → 45)几乎减半。结合最新的30T Token多模态预训练语料,GLM-5.3-Flash能够以更少的计算资源实现更强的性能。
GLM-5.3-Flash同时进行了多项架构升级,是首个采用稀疏注意力与线性注意力混合架构的开源前沿模型,在保持精准长上下文能力的同时,大幅降低长上下文服务成本;并采用流形约束超连接(Manifold-Constrained Hyper-Connections,mHC)提升模型Scaling能力。
极致低成本架构
为降低模型长上下文场景下的注意力成本,该模型采用线性注意力与稀疏注意力相结合的混合架构。其中,线性注意力通过递归机制捕获局部依赖关系,稀疏注意力则借助轻量级索引器召回全局上下文。引入IndexPool为进一步降低1M上下文下索引器的时延与内存开销,通过加权池化将索引器的4个缓存向量压缩为1个。
将GLM-5.3-Flash与GLM-5.3、DeepSeek-V4-Flash和Kimi-K3进行对比,重点考察单Token计算量和KV缓存大小。为公平比较不同规模的模型,分别展示每个Head、每层注意力计算量,以及每层平均KV缓存大小(BF16)。相较于GLM-5.3,GLM-5.3-Flash的注意力计算量与KV缓存大小分别降低了3.01倍和4.44倍。
![]()
在所有基线模型中,GLM-5.3-Flash的注意力计算量最低。不过其KV缓存大小仍略高于Kimi-K3和DeepSeek-V4-Flash。
代码循环中的视觉反馈
GLM-5.3-Flash是GLM-5系列的首个原生多模态模型。视觉编码(Visual Coding)并不只是处理图像,它拓展编程所能触及的边界。对于前端开发、游戏开发、3D仿真等任务而言,最终产物包括用户能够感知的界面、交互或虚拟世界,视觉能力被原生集成进模型中,使其能够自主判断何时需要“观察”,并利用视觉反馈来指导下一步行动。
GLM-5.3-Flash针对视觉编码开发了数据合成流水线,重点聚焦于模型的自我视觉判断与测试时改进。最终生成的轨迹要求模型与环境交互、检视自身输出,并进行迭代式改进。
在Blender中构建一个连贯的场景,需要将几何、材质、光照与空间等知识转化为一个在不同视角下都保持一致的3D结构。在没有任何外部素材的情况下,GLM-5.3-Flash自主运行16个小时搭建了一套约400平方米的专业主厨自宅与测试厨房。
专业能力更强的工作伙伴
GLM-5.3-Flash在专业工作中的表现相较同级别模型显著提升。针对PPTX、PDF、DOCX和XLSX等Office与文档类任务,新增的视觉理解能力使模型能够检查并优化自身输出,并具备更强的审美判断。模型还可以将自己的输出结果与视觉上下文以及预期的结果进行对比,从而实现更有效的自我验证和优化——包括更准确的呈现质量评估以及审美判断。
在金融方面,GLM-5.3-Flash可以覆盖从基于来源的金融研究、报告生成到金融建模与分析的完整流程,在整个过程中提供可追溯的参考依据。在法律方面可以审查合同中的费用、账户与责任条款,并按律师惯例批注留痕。它也能起草律师函、合同与诉讼文书,格式与版式符合实务规范,生成即可交付。
上星图调用GLM-5.3-Flash
步骤一:注册并登录AstraFlow星图
平台地址:https://astraflow.ucloud.cn/
步骤二:实名认证
使用服务前用户需要完成实名认证。
步骤三:创建API Key
进入模型服务平台-密钥管理。
平台地址:
https://astraflow.ucloud.cn/modelverse/api-keys
curl -X POST "https://api.modelverse.cn/v1/chat/completions" \-H "Content-Type: application/json" \-H "Authorization: Bearer your-api-key" \-d '{"model": "glm-5.3-flash","messages": [{"role": "system","content": "你是一名资深的全栈软件工程师,擅长前端开发、后端架构设计以及现代 Web 技术栈"},{"role": "user","content": "帮我设计并编写一个个人博客网站,包含首页、文章列表、文章详情页,使用 React + Node.js 技术栈"}],"thinking": {"type": "enabled"},"reasoning_effort": "max","stream": true,"max_tokens": 65536,"temperature": 1.0}'
下载星图客户端,无需复杂配置,即可一键调用GLM-5.3-Flash。无论是代码开发、资料整理、深度调研,还是PPT与文档生成,都能在一个客户端内高效完成,让强大的模型能力真正转化为触手可及的Agent生产力。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.