网易首页 > 网易号 > 正文 申请入驻

DeepSeek-V3.1正式发布,上下文均扩展为128K

0
分享至

作者:刘晓洁 责编:彭海斌

8月21日,业界千呼万唤的R2模型没来,但DeepSeek官方正式发布了新模型V3.1。从命名来看这或许不是一次大的版本更新,更像是前一代DeepSeek-V3模型的小版本迭代。

在X上,DeepSeek将V3.1称为“我们迈向智能体时代的第一步”(our first step toward the agent era)。本次升级主要有三大亮点,其中包括更强的Agent能力、混合思考模式和更高的思考效率。

官方表示,通过后训练优化,新模型在工具使用与智能体任务中的表现有较大提升。在编程智能体、搜索智能体测评中, V3.1相比之前的DeepSeek系列模型都有明显提高。

DeepSeek-V3.1是混合推理架构,一个模型同时支持思考模式和非思考模式。目前用户可在官方App与网页端体验新模型,通过“深度思考”按钮,实现思考模式与非思考模式的自由切换。DeepSeek API也已同步升级,deepseek-chat对应非思考模式,deepseek-reasoner对应思考模式,且上下文均已扩展为128K。

“混合推理非常棒。拥有一个能够在深度思考和快速响应之间切换的模型,感觉就像是实用人工智能的未来。”X上有网友表示,“在深度推理和快速反应之间切换真是天才之举。”根据查询调整深度,可以避免在简单任务上过度耗时,同时在需要时进行全面分析。

与之前的版本相比,V3.1也有更高的思考效率。官方表示,DeepSeek-V3.1-Think在保持与 DeepSeek-R1-0528相当的答案质量的同时,响应速度更快。

官方测试结果显示,经过思维链压缩训练后,V3.1-Think 在输出 token 数减少20%-50% 的情况下,各项任务的平均表现与 R1-0528持平。

在各项评测指标得分基本持平的情况下,R1-0528与 V3.1-Think 的 token 消耗量对比图

同时,V3.1在非思考模式下的输出长度也得到了有效控制,相比于 DeepSeek-V3-0324 ,能够在输出长度明显减少的情况下保持相同的模型性能。

同步地,DeepSeek进行了价格调整,模型的API接口调用价格有所上涨。自9月6日凌晨起,取消夜间时段优惠,输入价格上,缓存命中时为0.5元/百万tokens,缓存未命中的价格则为4元/百万tokens(此前V3为2元/百万tokens);输出价格为12元/百万tokens(此前V3为8元/百万tokens)。

官方提到,V3.1的基础模型在V3的基础上重新做了外扩训练,一共增加训练了840B tokens。基础模型与后训练模型均已在Huggingface与魔搭开源。

值得一提的是,DeepSeek此次还宣布增加了对海外模型Anthropic API格式的支持,官方提到这是“为了满足大家对 Anthoripic API 生态的使用需求”,用户可以将 DeepSeek-V3.1的能力接入Claude Code框架。

责任编辑:王凤枝_NT2541

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
新款不知火舞性感手办推出!前凸后翘难以抵挡!

新款不知火舞性感手办推出!前凸后翘难以抵挡!

游民星空
2026-05-03 23:45:02
感动!吴宜泽身披国旗举起世锦赛冠军 父母现场见证 母亲激动落泪

感动!吴宜泽身披国旗举起世锦赛冠军 父母现场见证 母亲激动落泪

我爱英超
2026-05-05 06:06:03
王晓晨前凸后翘,大白兔饱满,超爱了,这般魅力谁能不爱?

王晓晨前凸后翘,大白兔饱满,超爱了,这般魅力谁能不爱?

TVB的四小花
2026-05-05 07:36:47
冲突升级!阿联酋石油设施遭伊朗无人机袭击,燃起大火,多人受伤,伊朗:美国军事冒险所致!阿联酋称拦截15枚导弹、4架无人机

冲突升级!阿联酋石油设施遭伊朗无人机袭击,燃起大火,多人受伤,伊朗:美国军事冒险所致!阿联酋称拦截15枚导弹、4架无人机

每日经济新闻
2026-05-05 11:29:04
广东男篮出发北京!陈家政、黄明依随队,杜锋或调整12人大名单

广东男篮出发北京!陈家政、黄明依随队,杜锋或调整12人大名单

篮球大陆
2026-05-05 09:29:32
一场抢七定命运!活塞官宣续约比克斯塔夫 魔术炒掉主帅莫斯利

一场抢七定命运!活塞官宣续约比克斯塔夫 魔术炒掉主帅莫斯利

罗说NBA
2026-05-05 05:41:04
医生说,凡是得大病的人,都有这几个共性,句句都是大实话,很准

医生说,凡是得大病的人,都有这几个共性,句句都是大实话,很准

蝉吟槐蕊
2026-05-05 09:19:38
破防!詹姆斯为了侮辱我他!居然干这种事....

破防!詹姆斯为了侮辱我他!居然干这种事....

柚子说球
2026-05-05 13:25:30
伊朗媒体:两枚导弹击中穿越霍尔木兹海峡的美国军舰

伊朗媒体:两枚导弹击中穿越霍尔木兹海峡的美国军舰

新华社
2026-05-04 18:51:04
卡拉格:曼城1-3落后时阿尔特塔可能都要给莫耶斯开香槟了

卡拉格:曼城1-3落后时阿尔特塔可能都要给莫耶斯开香槟了

懂球帝
2026-05-05 09:46:22
回不来了!美国一句话,赖清德被架在火上烤,还想“顺”到美国?

回不来了!美国一句话,赖清德被架在火上烤,还想“顺”到美国?

知法而形
2026-05-04 17:45:49
小杨哥一家四口罕现身!懒理大徒弟小黄背刺,二二因劳累被推着走

小杨哥一家四口罕现身!懒理大徒弟小黄背刺,二二因劳累被推着走

裕丰娱间说
2026-05-05 10:25:42
当年的东北“地下市长”,霸占过20多位女明星,狠起来连自己都砍

当年的东北“地下市长”,霸占过20多位女明星,狠起来连自己都砍

为什么有冬天夏天
2024-05-08 23:38:12
权志龙穿涉种族歧视T恤登台!公司火速道歉

权志龙穿涉种族歧视T恤登台!公司火速道歉

喜欢历史的阿繁
2026-05-04 20:04:49
过气明星太可怜?五一假期景区落魄打工,有人无戏可拍,令人心酸

过气明星太可怜?五一假期景区落魄打工,有人无戏可拍,令人心酸

揽星河的笔记
2026-05-04 15:45:23
尴尬!安徽一妈妈为女儿单招录取民办专科办升学宴,强硬回怼嘲讽

尴尬!安徽一妈妈为女儿单招录取民办专科办升学宴,强硬回怼嘲讽

火山詩话
2026-05-04 07:59:31
游客拍巴塘公厕脏乱被工作人员围堵,两次报警脱身,官方通报致歉

游客拍巴塘公厕脏乱被工作人员围堵,两次报警脱身,官方通报致歉

阿丰聊娱
2026-05-04 20:33:57
豆包,你这么垃圾,怎么好意思收费?

豆包,你这么垃圾,怎么好意思收费?

崇晓视界
2026-05-04 17:24:53
倒反天罡!法官向刺杀川普的枪手道歉

倒反天罡!法官向刺杀川普的枪手道歉

大洛杉矶LA
2026-05-05 06:11:22
调整!5月5日央视直播世乒赛有变,16强诞生,林诗栋梁靖崑再出战

调整!5月5日央视直播世乒赛有变,16强诞生,林诗栋梁靖崑再出战

等等talk
2026-05-05 10:38:52
2026-05-05 13:48:49
第一财经资讯 incentive-icons
第一财经资讯
第一财经官方账号
252301文章数 622198关注度
往期回顾 全部

科技要闻

OpenAI/Anthropic同日被曝拉拢华尔街建合资公司

头条要闻

吴宜泽18-17夺冠:1家3口"兵分两路"10年 已押上一切

头条要闻

吴宜泽18-17夺冠:1家3口"兵分两路"10年 已押上一切

体育要闻

全世界都等着看他笑话,他带国米拿下冠军

娱乐要闻

英皇25周年演唱会 张敬轩被救护车拉走

财经要闻

五一假期,中国年轻人的“首尔病”犯了

汽车要闻

同比大涨190% 方程豹4月销量29138台

态度原创

旅游
亲子
本地
公开课
军事航空

旅游要闻

十载筑梦向新行 乐享初夏梦享券——2026上海国际旅游度假区第二轮“梦享券”开抢在即

亲子要闻

为什么古代育儿总离不开这两样东西?

本地新闻

用青花瓷的方式,打开西溪湿地

公开课

李玫瑾:为什么性格比能力更重要?

军事要闻

特朗普回绝伊朗新方案

无障碍浏览 进入关怀版