网易首页 > 网易号 > 正文 申请入驻

DeepSeek V3.1 Base突袭上线!击败Claude 4编程爆表,全网在蹲R2和V4

0
分享至


新智元报道

编辑:桃子 定慧

【新智元导读】DeepSeek V3.1新版正式上线,上下文128k,编程实力碾压Claude 4 Opus,成本低至1美元。

就在昨晚,DeepSeek官方悄然上线了全新的V3.1版本,上下文长度拓展到128k。


本次开源的V3.1模型拥有685B参数,支持多种精度格式,从BF16到FP8。

综合公开信息和国内大咖karminski3的实测,V3.1此次更新亮点有:

  • 编程能力:表现突出,根据社区使用Aider测试数据,V3.1在开源模型中霸榜。

  • 性能突破:V3.1在Aider编程基准测试中取得71.6%高分,超越Claude Opus 4,同时推理和响应速度更快。

  • 原生搜索:新增了原生「search token」的支持,这意味着搜索的支持更好。

  • 架构创新:线上模型去除「R1」标识,分析称DeepSeek未来有望采用「混合架构」。

  • 成本优势:每次完整编程任务仅需1.01美元,成本仅为专有系统的六十分之一。

值得一提的是,官方群中强调拓展至128K上下文,此前V3版本就已经支持。


对于这波更新,大家的热情可谓是相当高涨。

即便还未公布模型卡,DeepSeek V3.1就已经在Hugging Face的趋势榜上排到了第四。



DeepSeek粉丝数已破8万

看到这里,网友们更期待R2的发布了!


混合推理,编程击败Claude 4

这次最明显的变化是,DeepSeek在官方APP和网页端上,把深度思考(R1)中的「R1」去掉了。


同时,与V3-base相比,DeepSeek V3.1新增了四个特殊Token:

  • <|search▁begin|> (id: 128796)

  • <|search▁end|> (id: 128797)

  • (id: 128798)

  • (id: 128799)


对此,有推测认为,这可能暗示推理模型与非推理模型的融合。


在编程方面,根据网友曝出的结果,DeepSeek V3.1在Aider Polyglot多语言编程测试中拿下了71.6%高分,一举击败了Claude 4 Opus、DeepSeek R1。


而且,它的成本仅1美元,成为非推理模型中的SOTA。


最鲜明的对比,V3.1编程性能比Claude 4高1%,成本要低68倍。


在SVGBench基准上,V3.1实力仅次于GPT-4.1-mini,远超DeepSeek R1的实力。


在MMLU多任务语言理解方面,DeepSeek V3.1毫不逊色于GPT-5。不过在,编程、研究生级基准问答、软件工程上,V3.1与之有一定的差距。


一位网友实测,模拟六边形中小球自由落体的物理测试,DeepSeek V3.1理解力明显提升。


一手实测

第一时间,我们对V3.1进行了实测,首先是此次模型更新的重点:上下文长度。

假设对于中文而言,1个token ≈ 1–1.3个汉字,那么这128K tokens ≈ 100,000–160,000汉字。

相当于整本《红楼梦》正文(约80–100万字)的1/6–1/8,或者一篇超长博士论文/大部头学术专著

实际测试也很准确,DeepSeek告诉我们它只能阅读差不多9%,也就是大约十分之一。


由于总结内容太长,我们截取了前三回,你觉得这个总结的怎么样?


在128K上下文测试中,DeepSeek-V3.1输出速度相比以往获得较大提升,并且在工程上做了一些优化。


此次更新,DeepSeek重点强调了对上下文的支持。

整个活,给DeepSeek-V3.1上点压力,让它根据「梦」这个字,输出尽可能多的内容,尽量达到上下文极限。


不过最后,差不多只输出了3000字左右,模型就停止了输出。


再来看下推理能力。

经典的9.11和9.9比大小问题,两种询问方式都能正确做答。

这次更新的一大体感还是速度变快了很多。


最后再来看看编程能力。

DeepSeek的上一个模型是R1-0528,主打的是编程能力。

看看这次V3.1是否有更大的提升。


最终结果只能说,打个80分吧,基本要求都满足了,但是画面风格和颜色变换功能并没有完美实现。


并且和R1-0528的结果相比,两者之间还是有些差距的,但孰好孰坏还需看个人偏好。

以下是开启思考模式后的结果,你觉得哪个更好?


接下来,看看DeepSeek V3.1能否复刻出GPT-5发布会上的法语学习小程序。

我们再来让V3.1画一个自己的SVG自画像,两种效果着实有些抽象。




参考资料:HYX

https://weibo.com/2169039837/Q0FC4lmeo

https://x.com/karminski3/status/1957928641884766314

https://github.com/johnbean393/SVGBench/

https://huggingface.co/deepseek-ai/DeepSeek-V3.1-Base



特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
雷军转发“诅咒”帖引巨大争议

雷军转发“诅咒”帖引巨大争议

电动知家
2026-01-13 10:04:15
大V建议没钱取暖的河北农村老人可以到海南云南两广旅居过冬

大V建议没钱取暖的河北农村老人可以到海南云南两广旅居过冬

西虹市闲话
2026-01-13 13:46:51
女首相掀桌了!

女首相掀桌了!

新动察
2026-01-13 15:29:51
脸都不要了!格力新空调的箱子正面直接印着“全铜管”这几个字

脸都不要了!格力新空调的箱子正面直接印着“全铜管”这几个字

忠于法纪
2026-01-13 20:43:38
株洲灿灿跟风杀猪,比呆呆还野!文旅提前6天准备,却被网友骂惨

株洲灿灿跟风杀猪,比呆呆还野!文旅提前6天准备,却被网友骂惨

李健政观察
2026-01-13 15:57:55
29岁网红口子姐去世,父亲病逝,自曝得梅毒,欠债太多下海惹争议

29岁网红口子姐去世,父亲病逝,自曝得梅毒,欠债太多下海惹争议

揽星河的笔记
2026-01-13 13:05:05
悲催!珠海一33年工厂破产,几百人饭碗没了,涉及司法案件363条

悲催!珠海一33年工厂破产,几百人饭碗没了,涉及司法案件363条

火山诗话
2026-01-13 13:15:14
改完行程后,王毅被高规格接待,中方坐上专车,美国威胁非洲小国

改完行程后,王毅被高规格接待,中方坐上专车,美国威胁非洲小国

时时有聊
2026-01-13 21:14:16
王石田朴珺运动照流出!网友:这老头,太不容易了……

王石田朴珺运动照流出!网友:这老头,太不容易了……

麦杰逊
2026-01-13 12:09:35
1984年贺子珍在上海病逝,市委不敢定丧葬规格,邓小平看后只说了一句话,结局出人意料

1984年贺子珍在上海病逝,市委不敢定丧葬规格,邓小平看后只说了一句话,结局出人意料

历史回忆室
2026-01-11 22:43:10
国产车企警惕!特斯拉FSD即将入华,技术代差恐进一步拉大

国产车企警惕!特斯拉FSD即将入华,技术代差恐进一步拉大

燕梳楼频道
2026-01-12 21:14:25
合川杀猪饭刚结束,榜一大哥坐不住了,上门邀请呆呆参加公司活动

合川杀猪饭刚结束,榜一大哥坐不住了,上门邀请呆呆参加公司活动

天天热点见闻
2026-01-13 12:31:28
伴郎破坏婚礼后续:新娘发声,男子正脸被扒,新郎做法令人失望

伴郎破坏婚礼后续:新娘发声,男子正脸被扒,新郎做法令人失望

青梅侃史啊
2026-01-13 08:53:07
伊朗今日公开处决抗议者,美国和以色列究竟在干什么?

伊朗今日公开处决抗议者,美国和以色列究竟在干什么?

史政先锋
2026-01-13 14:47:23
特斯拉授予高级副总裁朱晓彤超52万股股票期权:行权价435.8美元,完全归属要等五年后

特斯拉授予高级副总裁朱晓彤超52万股股票期权:行权价435.8美元,完全归属要等五年后

新浪财经
2026-01-13 21:28:27
柬埔寨街头“狗笼运活人”视频疯传,警方:与人口贩运无关

柬埔寨街头“狗笼运活人”视频疯传,警方:与人口贩运无关

红星新闻
2026-01-13 13:34:29
盯上6000米深海稀土!日本派船探查,距中国加强两用物项出口管制不到一周!高市早苗已决定提前大选

盯上6000米深海稀土!日本派船探查,距中国加强两用物项出口管制不到一周!高市早苗已决定提前大选

每日经济新闻
2026-01-13 15:11:06
“刨猪汤”瞬间刹停,“呆呆”妹无比明智

“刨猪汤”瞬间刹停,“呆呆”妹无比明智

不主流讲话
2026-01-13 11:09:37
美军对伊朗的打击,已经是箭在弦上了

美军对伊朗的打击,已经是箭在弦上了

寰宇大观察
2026-01-13 18:35:03
伊朗抗议血腥镇压:数百青年头颈中枪殒命,23岁女大学生遗体被扣

伊朗抗议血腥镇压:数百青年头颈中枪殒命,23岁女大学生遗体被扣

译言
2026-01-13 11:00:50
2026-01-13 23:47:00
新智元 incentive-icons
新智元
AI产业主平台领航智能+时代
14326文章数 66456关注度
往期回顾 全部

科技要闻

每年10亿美元!谷歌大模型注入Siri

头条要闻

员工被辞退索赔89万遭公司反诉索赔214万 历时2年判了

头条要闻

员工被辞退索赔89万遭公司反诉索赔214万 历时2年判了

体育要闻

他带出国乒世界冠军,退休后为爱徒返场

娱乐要闻

蔡卓妍承认新恋情,与男友林俊贤感情稳定

财经要闻

"天量存款"将到期 资金会否搬入股市?

汽车要闻

限时9.99万元起 2026款启辰大V DD-i虎鲸上市

态度原创

旅游
本地
艺术
时尚
房产

旅游要闻

仙游:山水织诗意 产业耀华章

本地新闻

云游内蒙|到巴彦淖尔去,赴一场塞上江南的邀约

艺术要闻

书法争议再起:拙与妍孰优孰劣引发热议

今年春天,外套长一点会更美!

房产要闻

又一新校开建!海口这一片区,迎来教育重磅升级!

无障碍浏览 进入关怀版