并不是每一次向人工智能发出提示,都需要用到Opus 4.8。随着一味追求高令牌消耗的热潮逐渐退去,一些人工智能用户开始思考,怎样才能把钱花得更值,同时控制每月成本。美国加密货币交易平台 Coinbase 首席执行官布赖恩·阿姆斯特朗分享了这家公司的做法:在合适的情况下,不必吝于使用更便宜的模型。
![]()
阿姆斯特朗周日在社交平台 X 上写道:“我们正努力在适当的时候把提示请求分配给更便宜的模型。在某些情况下,尽管令牌使用量仍在指数级增长,我们还是把成本大致维持在持平水平。”
![]()
像 Opus 4.8 或 GPT-5.5 这样的最新模型,虽然承诺提供最前沿的能力,但也可能消耗更多令牌,而且这还不包括开启快速模式之后的额外消耗。Anthropic 推出 Opus 4.7 时,许多用户就抱怨自己很快触及使用速率上限。
![]()
阿姆斯特朗写道,他预计“未来12到18个月内,80%的工作负载将运行在便宜99%的模型上”。他还预测,用户只有在需要“把智力拉满”时,才会使用最新模型。这类场景包括科学突破或智能体编排。阿姆斯特朗写道:“这让我认为,真正的限制因素将是能源和算力,而不是更好的模型。”
阿姆斯特朗这番表态引起了一些科技界知名人士的注意。风险投资人马克·安德森称这“很有意思”。人工智能平台 Hugging Face 联合创始人朱利安·肖蒙德写道,如今“模型路由正在迅速增长”。
![]()
云内容管理公司 Box 首席执行官亚伦·莱维写道,阿姆斯特朗给出的数字“有点极端”,但未来几年人工智能的使用很可能会出现分层。莱维认为,“高端”工作将由领先模型完成,而“高容量”工作则会交给廉价模型。
法律人工智能公司 Harvey 联合创始人温斯顿·温伯格写道:“如何分配智能将变得极其重要。”这种强调效率的思路出现得相对较晚,至少公开宣扬这一点还是近来的事。不久前,在“令牌越多越好”盛行时,科技行业领袖还会晒出自己高昂的令牌账单,或炫耀自己使用最新模型的情况。
![]()
这种心态在初创企业圈尤其流行。创业孵化器 Y Combinator 首席执行官加里·谭曾建议创业者在令牌使用上“放开手脚”。一位获得 Y Combinator 支持的创业公司创始人兰斯·严今年4月对《商业内幕》表示,限制令牌使用“很愚蠢”。
![]()
不过,风向似乎正在变化。企业搜索公司 Glean 联合创始人托尼·詹蒂尔科尔评论说,阿姆斯特朗的帖子“完全说对了”。詹蒂尔科尔写道:“所有技术人员其实早就知道这一点。只有金融市场还在把 Opus 的价格无限外推,仿佛它能支撑无限规模。”
特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。
Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.