21世纪经济报道记者 孔海丽
智谱今日正式上线GLM-5.3-FlashX,API同步全面开放。新版本推理速度最高可达200 tokens/s,是GLM-5.3-Flash速度的5倍,定价提升至原版的2.5倍。
GLM-5.3-FlashX就是那个被称为“神秘模型”“牛来模型”的GLM-5.3-Flash升级版,速度更快、价格更高。
8月20日,GLM-5.3-Flash以“Ox Alpha”匿名模式在OpenRouter上线测试,因为来路不明、表现强劲,被网友戏称“牛来”,直到8月26日智谱才正式认领并开源。
据智谱介绍,由10万张国产芯片组成的推理集群上线即满负荷运行。面对超预期的需求,智谱再次扩大算力规模,并推出速度更快、定价更高的FlashX版本,以承接不断增长的调用需求。
GLM-5.3-Flash凭借同尺寸模型中领先的智能水平与高性价比积累了竞争优势。此次FlashX将输出速度提升至最高200 tokens/s,在保持智能水平的同时,进一步提升响应效率,为重视速度与交互体验的开发者提供新的选择。
值得关注的是,GLM-5.3-Flash此前已具备较为可观的毛利率,FlashX提价有望带动收入和利润率同步提升。
9月18日,智谱股价盘中涨幅达6.42%,报787.5港元/股。
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.