网易首页 > 网易号 > 正文 申请入驻

深夜重磅!全球首个混合推理模型Claude 3.7 Sonnet发布,编程水平达到SOTA

0
分享至

今日凌晨,Anthropic 突然发布了全球首款混合推理模型、迄今为止最好的编码模型——Claude 3.7 Sonnet。(Claude 4.0 还要再等一等[皱眉])

据官方介绍,Claude 3.7 Sonnet 具有“一个模型,两种思考方式”(One model, two ways to think)的特点,即标准和扩展思考模式。用户可以选择何时让模型正常回答问题,何时让模型思考更长时间再回答问题。

“正如人类使用单个大脑进行快速反应和深度思考一样,我们认为推理应该是前沿模型的一种综合能力,而不是完全独立的模型。这种统一的方法还能为用户带来更完美的体验。”

Claude 3.7 Sonnet 可以生成近乎即时的响应,也可以生成用户可见的扩展、逐步思考的结果,在编码和前端网络开发方面的改进尤为显著。

另外,API 用户还可以对模型的思考时间进行精细控制。例如,用户可以告诉 Claude 思考的时间不超过 N 个 token,无论 N 为多少,其输出限制为 128K 个 token。这允许用户在速度(和成本)和答案质量之间进行权衡。

早期测试表明,Claude 3.7 Sonnet 的编码能力全面领先于其它模型,在处理复杂代码库和高级工具使用等方面都有显著改进。在评估 LLM 解决 GitHub 上真实软件问题能力的基准测试数据集 SWE-bench Verified 上,Claude 3.7 Sonnet 的表现达到了 SOTA。

在评估 LLM 在复杂真实场景中用户与工具交互能力的基准 TAU-bench 上,Claude 3.7 Sonnet 超过了 Claude 3.5 Sonnet 和 OpenAI 的 o1,达到了 SOTA。

除了 Claude 3.7 Sonnet ,Anthropic 还推出了一个用于代理编码的命令行工具——Claude Code,能够使开发人员可以直接从终端将大量工程任务委托给 Claude。

此外,Anthropic 还对外展示了他们的发展图景——2025 年,Claude 成为独立自主工作数小时的专家级智能体;2027 年,Claude 能够解决人工团队花费数年才能解决的挑战性难题[加油]。

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
心源性猝死人数逐渐增多,医生建议:少吃鸡肉,多喝7样增强免疫

心源性猝死人数逐渐增多,医生建议:少吃鸡肉,多喝7样增强免疫

垚垚分享健康
2026-03-26 16:09:56
张雪峰去世真相!网友:偌大的公司靠他个人ip养活,早死是必然的

张雪峰去世真相!网友:偌大的公司靠他个人ip养活,早死是必然的

火山詩话
2026-03-25 09:18:58
张雪峰亲手把自己送上了死路

张雪峰亲手把自己送上了死路

名人苟或
2026-03-25 06:02:57
日本网民真怕了,呼吁严惩闯入中国使馆的暴徒,防止226事件再现

日本网民真怕了,呼吁严惩闯入中国使馆的暴徒,防止226事件再现

知法而形
2026-03-25 18:38:56
跌光2500亿!泡泡玛特,股价崩塌

跌光2500亿!泡泡玛特,股价崩塌

财经锐眼
2026-03-26 18:54:18
张雪峰去世仅两天!公司宣布重大决定:收回他所有肖像使用权

张雪峰去世仅两天!公司宣布重大决定:收回他所有肖像使用权

娱乐圈圈圆
2026-03-26 21:47:07
岛上设陷阱,海上堵两头!伊朗布下天罗地网,曼德海峡将成美国经济新“放血点”?

岛上设陷阱,海上堵两头!伊朗布下天罗地网,曼德海峡将成美国经济新“放血点”?

红星新闻
2026-03-26 18:34:31
张雪峰前女友哭红眼,喊话不要给他泼脏水,曝两人分手原因

张雪峰前女友哭红眼,喊话不要给他泼脏水,曝两人分手原因

茶韵浮生
2026-03-26 20:26:51
刚刚,《柳叶刀》杀人诛心:你每天灌再多的水,也防不了肾结石!

刚刚,《柳叶刀》杀人诛心:你每天灌再多的水,也防不了肾结石!

徐德文科学频道
2026-03-26 19:03:36
盲目的大学扩招,正在反噬整个社会

盲目的大学扩招,正在反噬整个社会

凡人志
2026-03-25 01:34:53
美团:2025年营收3,648.5亿元人民币 同比增长8.1%

美团:2025年营收3,648.5亿元人民币 同比增长8.1%

财联社
2026-03-26 17:40:04
尺度大到曾下架!模特冠军泳装大雷出演影游即将发售

尺度大到曾下架!模特冠军泳装大雷出演影游即将发售

游民星空
2026-03-26 11:58:13
中方拒收道歉,日本自卫官被转移,小泉进次郎沉默24小时后发声

中方拒收道歉,日本自卫官被转移,小泉进次郎沉默24小时后发声

何氽简史
2026-03-26 15:40:58
禁止将居民住宅专门用于安放骨灰!

禁止将居民住宅专门用于安放骨灰!

北青网-北京青年报
2026-03-26 16:11:05
网友曝张雪峰抢救细节:倒地30分钟才被发现,用ECMO全力抢救无效

网友曝张雪峰抢救细节:倒地30分钟才被发现,用ECMO全力抢救无效

半窗疏影
2026-03-26 20:17:36
内塔尼亚胡妻子:我儿子就因是以总理孩子被羞辱

内塔尼亚胡妻子:我儿子就因是以总理孩子被羞辱

看看新闻Knews
2026-03-26 14:21:02
引而不发才是王道,封锁霍尔木兹海峡,伊朗打完了最后一张牌……

引而不发才是王道,封锁霍尔木兹海峡,伊朗打完了最后一张牌……

家传编辑部
2026-03-26 10:34:27
俄军北极最强战舰,被击沉!乌军集中390架自杀机饱和突破成功

俄军北极最强战舰,被击沉!乌军集中390架自杀机饱和突破成功

沧海旅行家
2026-03-26 18:23:44
到底有多无知,才能做出这样的判决!

到底有多无知,才能做出这样的判决!

槽三刀
2026-03-25 22:01:04
广东报告梅大高速“5·1”塌方灾害整改落实情况:发现公路隐患1.6万余处

广东报告梅大高速“5·1”塌方灾害整改落实情况:发现公路隐患1.6万余处

封面新闻
2026-03-26 15:36:07
2026-03-27 00:55:00
学术头条
学术头条
致力于学术传播和科学普及,重点关注AI4Science、大模型等前沿科学进展。
1430文章数 5081关注度
往期回顾 全部

科技要闻

美团发布外卖大战后成绩单:亏损超200亿

头条要闻

张雪峰留巨额遗产:二婚妻子或拿50% 剩下的女儿占1/3

头条要闻

张雪峰留巨额遗产:二婚妻子或拿50% 剩下的女儿占1/3

体育要闻

申京努力了,然而杜兰特啊

娱乐要闻

刘晓庆妹妹发声!称姐姐受身边人挑拨

财经要闻

油价"驯服"特朗普?一到100美元就TACO

汽车要闻

一汽奥迪A6L e-tron开启预售 CLTC最大续航815km

态度原创

手机
游戏
亲子
艺术
公开课

手机要闻

1499 iQOO Z11系列发布丨9020mAh电池 165Hz高刷

PS1大IP游戏藏私货!成人手绘与盗版马里奥ROM塞满

亲子要闻

看看把孩子吓得哈哈哈

艺术要闻

都说乌克兰美女多,看完摄影师贝格玛 的作品我信了!

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版