Cerebras与OpenAI近日联合推出Ultrafast Mode(超快模式),这是一个全新的服务层级,率先在OpenAI API中上线,由Cerebras提供底层算力支持。该模式初期仅向部分精选客户开放,后续将逐步扩大使用范围。在超快模式下,GPT-5.6 Sol的输出速度最高可达每秒750个token,且不牺牲任何回复质量,从而能够加速用户最耗时、最关键的业务任务。 长期以来,AI开发者不得不在速度与智能之间做出取舍。随着模型在规模与智能水平上的不断提升,其计算和数据迁移成本也随之增加,导致响应时间变慢。用户往往需要等待高质量结果,或者被迫在更短时间内接受较差的输出。 GPT-5.6 Sol Ultrafast的出现打破了这一两难局面,将前沿智能带入每一秒都至关重要的产品与工作流中。根据Artificial Analysis报告的对比数据,GPT-5.6 Sol在Ultrafast模式下的输出速度比Fable 5快11倍,比Opus 4.8的Fast模式快5倍。 Cerebras还使用Humanity's Last Exam(HLE)基准对Ultrafast进行了实测。HLE是一项极具挑战性的模型评测基准,包含2500道通常只有化学、经济学、文学等领域博士才能作答的问题。 在评估中,GPT-5.6 Sol超快模式仅用11小时11分钟便完成了全部2500道HLE题目。而Claude Fable 5完成同样的题目需要78小时27分钟,相当于超过三天的持续计算。换言之,Ultrafast在一个工作日内就攻克了人类知识的前沿难题,并且以接近7倍的速度达到了相近的准确率。 本次基准测试由Cerebras执行:GPT-5.6 Sol Ultrafast搭配Codex,采用xhigh推理级别,测试日期为7月10日;Claude Fable 5搭配Claude Code,同样采用xhigh推理级别,测试日期为7月13日至15日。 随着模型能力的持续进步,快速推理将在越来越多的应用场景中发挥关键作用。
![]()
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.