网易首页 > 网易号 > 正文 申请入驻

刚刚曝光的 Claude3,直击 OpenAI 最大弱点

0
分享至

企业级 SOTA 大模型,Anthropic 的 Claude3 释放了哪些信号?


作者 | 宛辰
编辑| 靖宇

作为 OpenAI GPT3 研发负责人的创业项目,Anthropic 被视为最能与 OpenAI 抗衡的一家创业公司。

当地时间周一,Anthropic 发布了一组 Claude 3 系列大模型,称其功能最强大的模型在各种基准测试中均优于 OpenAI 的 GPT-4 和 Google 的 Gemini 1.0 Ultra。

但是,能处理更复杂的推理任务、更智能、更快响应,这些跻身大模型 Top3 的综合能力只是 Claude3 的基本功。

Anthropic 致力于成为企业客户的最佳拍档

这是首先体现在 Claude3 是一组模型:Haiku、Sonnet 和 Opus,让企业客户根据自身场景选择不同性能、不同成本的版本。

其次,Anthropic 强调自家模型是最安全的。Anthropic 总裁 Daniela Amodei 介绍,在 Claude3 的训练中引入了一种叫做「宪法人工智能」的技术,增强其安全、可信、可靠

在看完 Claude3 的技术报告后,爱丁堡大学大模型和推理方向博士生符尧称,Claude3 在一些复杂推理的基准测试上表现尤其显著,尤其在金融和医疗领域,作为一家 ToB 公司,Anthropic 选择优化最挣钱的领域。

现在,Anthropic 在 159 个国家开放使用 Claude3 系列的两款模型(Haiku 和 Sonnet),最强版本 Opus 也即将推出。同时,Anthropic 也通过亚马逊和谷歌的云平台提供服务,后者曾分别向 Anthropic 注资 40 亿美元和 20 亿美元

01

更智能、响应更快的

Claude3 家族:

Opus、Sonnet 和 Haiku

据 Anthropic 官网,Claude3 是一系列模型,包含三种最先进的模型:Claude 3 Haiku、Claude 3 Sonnet 和 Claude 3 Opus,允许用户为其特定应用选择智能、速度和成本的最佳平衡。

在模型的通用能力上,Anthropic 称 Claude 3 系列「为广泛的认知任务树立了新的行业基准」,在分析和预测、细致内容的生成、代码生成以及西班牙语、日语和法语等非英语语言对话方面,现实出更强大的能力,在任务响应上也更及时。

其中,Claude 3 Opus 是这组模型中最智能的模型,尤其在高度复杂的任务处理上。Opus 在大多数常见的评测基准中都优于同行,包括本科水平专家知识 (MMLU)、研究生水平专家推理 (GPQA)、基础数学 (GSM8K) 等。它在复杂任务上表现出接近人类水平的理解力和流畅性,是目前 Anthropic 对于通用智能最前沿的探索,「展示了生成式人工智能的外部极限」。

Claude 3 Sonnet 在智能水平和响应速度之间实现了理想的平衡,尤其对于企业场景下的任务。与同类产品相比,它以更低的成本提供了强大的性能,并且专为大规模人工智能部署中的高耐用性(high endurance)而设计。对于绝大多数工作负载,Sonnet 的速度比 Claude 2 和 Claude 2.1 快 2 倍,且智能水平更高。它擅长执行需要快速响应的任务,例如知识检索或销售自动化。

Claude 3 Haiku 是最紧凑的模型,并且也最具成本效益。并且,它的响应速度也很快,可以在不到三秒的时间内阅读 arXiv 上包含图表、图形的信息以及数据密集的研究论文(约 10k token)。

02

瞄准企业客户的迭代

联合创始人 Daniela Amodei 介绍,除了通用智能的进步,Anthropic 特别关注企业客户把生成式 AI 集成到他们的业务时,所面临的许多挑战。针对企业客户,Claude3 家族在视觉能力、准确性、长文本输入和安全方面,都有进步。

很多企业客户的知识库拥有多种格式,PDF、流程图或演示幻灯片。现在,Claude 3 系列模型可以处理各种视觉格式的内容,包括照片、图表、图形和技术图表。

Claude3 还优化了准确性和长文本窗口的能力。

在准确性上,Anthropic 使用了大量复杂的事实问题来针对当前模型中已知的弱点,将答案分为正确答案、错误答案(或幻觉)和承认不确定性。相应地,Claude3 模型表示它不知道答案,而不是提供不正确的信息。其中最强的版本 Claude 3 Opus 在具有挑战性的开放式问题上的准确性(或正确答案)上,比 Claude 2.1 提高了一倍,同时也减少了错误答案的水平。

同时,由于语境理解能力的提升,Claude3 家族相比之前的版本,在响应用户任务上会作出更少的拒绝回答。

除了更准确的回复,Anthropic 称将在 Claude 3 带来「引用功能,可以指向参考材料中的精确句子来验证他们的答案

当前,Claude 3 系列模型将提供 200K token 的上下文窗口。后续,所有这三种模型都能够接受超过 100 万 token 的输入,这部分能力会提供给需要增强处理能力的精选客户。Anthropic 在技术报告中简单阐述了 Claude3 的上文本窗口能力,包括有效处理更长的上下文提示词,以及回忆能力。

03

「宪法人工智能」,

应对「不精确的科学」

值得注意的是,Claude3 作为多模态模型,可以输入图像,但无法输出图像内容。联合创始人 Daniela Amodei 称,这是因为「我们发现企业对图像的需求要少得多」。

Claude3 的发布是在谷歌 Gemini 生成图片引发争议后发布的,面向企业客户的 Claude 也免不了在 AI 所引发的价值观偏见等问题上的控制与平衡。

对此,Dario Amodei 强调了控制人工智能模型的难度,称其为「不精确的科学」。他表示,该公司有专门的团队致力于评估和减轻模型带来的各种风险。

另一位联合创始人 Daniela Amodei 也承认,用目前的方法可能无法实现完全无偏见的人工智能。「创建一个完全中立的生成式人工智能工具几乎是不可能的,不仅在技术上,而且还因为并不是每个人都同意什么是中立。」她说。

尽管如此,Anthropic 用一种称为「宪法人工智能」方法来尽可能使模型和人类广泛的价值观一致,模型遵循「宪法」中定义的原则来调整优化。

作为 OpenAI 曾经的核心人发人员,Amodei 兄妹的出走跟近日马斯克对 OpenAI 的一纸诉状有相同点,认为 OpenAI 不再是一个非赢利组织,不再遵循最初使命造福人类。有记者问 Amodei,Anthropic 符合你出走创业的愿景吗?

Amodei 说:「处于人工智能发展的前沿,是引导人工智能发展轨迹为社会带来积极成果的最有效方式。」

*头 图来源:Anthropic

本文为极客公园原创文章,转载请联系极客君微信 geekparkGO

15 个月,英伟达市值从 3000 万美元暴涨到 2 万亿——AI 炒作总有起伏,为何它能一直涨?算力霸主地位,英伟达能持续多久?未来 LLM 的算力需求又将走向何方?

3 月 5 日(周二)20:00,极客公园视频号直播间,来聊聊英伟达的「增长密码」究竟是什么?

特别声明:以上内容(如有图片或视频亦包括在内)为自媒体平台“网易号”用户上传并发布,本平台仅提供信息存储服务。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相关推荐
热点推荐
董卿父亲发文悼念亡妻,句句不提女婿,却句句都是对密春雷的寒心

董卿父亲发文悼念亡妻,句句不提女婿,却句句都是对密春雷的寒心

孤芳自赏的小李
2026-06-30 12:16:55
清北都不上?湖北状元702分拒绝北大清华,他的选择让所有人沉默

清北都不上?湖北状元702分拒绝北大清华,他的选择让所有人沉默

金哥说新能源车
2026-06-30 06:15:10
苏提达巴黎出尽风头!73岁布丽吉特发型翻车,泰王冷脸看女儿下跪

苏提达巴黎出尽风头!73岁布丽吉特发型翻车,泰王冷脸看女儿下跪

白露文娱志
2026-06-30 15:19:46
中方:我们得知近期俄乌双方都承受了巨大苦难,单月平民伤亡人数达战争爆发以来的峰值,令人痛心

中方:我们得知近期俄乌双方都承受了巨大苦难,单月平民伤亡人数达战争爆发以来的峰值,令人痛心

政知新媒体
2026-06-30 11:00:42
俄鹰派敦促对乌进行核打击,布达诺夫:你动核武器试试

俄鹰派敦促对乌进行核打击,布达诺夫:你动核武器试试

史政先锋
2026-06-27 21:48:03
81岁菜农被博主买下所有菜后回家路上遇车祸离世 家属发声:别寒了好人的心

81岁菜农被博主买下所有菜后回家路上遇车祸离世 家属发声:别寒了好人的心

封面新闻
2026-06-30 18:08:22
这位像雕塑的刚果球迷,在夜店证明了:他也会动

这位像雕塑的刚果球迷,在夜店证明了:他也会动

快乐加载中21
2026-06-30 00:03:49
“中国为什么不踢世界杯?”外国网友的答案,让中国球迷沉默了

“中国为什么不踢世界杯?”外国网友的答案,让中国球迷沉默了

留学生日报
2026-06-30 09:11:23
649分儿子非要报哈工大,湖南妈妈求助,两千多评论没有一个站她

649分儿子非要报哈工大,湖南妈妈求助,两千多评论没有一个站她

解说阿洎
2026-06-30 01:55:55
Shams:中锋托马斯-布莱恩特计划一年合同重返骑士

Shams:中锋托马斯-布莱恩特计划一年合同重返骑士

北青网-北京青年报
2026-06-30 19:22:02
半夜窗户爬进来个男人,女主人一看身强体壮,干脆放弃报警

半夜窗户爬进来个男人,女主人一看身强体壮,干脆放弃报警

那年秋天
2026-06-30 12:42:18
蜱虫钻入孩子皮肤,妈妈“两拒绝一动作”救了娃,医生夸她做得好

蜱虫钻入孩子皮肤,妈妈“两拒绝一动作”救了娃,医生夸她做得好

菁妈育儿
2026-06-27 18:49:27
民心所向!四川航空发布,7月底全部回迁双流,终于不用再跑天府了

民心所向!四川航空发布,7月底全部回迁双流,终于不用再跑天府了

小蜜情感说
2026-06-30 20:21:16
4-5爆冷!世界杯4冠王出局,创96年耻辱纪录,阿根廷卫冕希望变大

4-5爆冷!世界杯4冠王出局,创96年耻辱纪录,阿根廷卫冕希望变大

球场没跑道
2026-06-30 08:09:25
日本内阁:日本就日本20家公司被列入出口管制名单向中国提出抗议

日本内阁:日本就日本20家公司被列入出口管制名单向中国提出抗议

俄罗斯卫星通讯社
2026-06-30 15:59:03
日本出局不可怕,可怕的是赛后森保一的宣言!黄健翔直接点破事实

日本出局不可怕,可怕的是赛后森保一的宣言!黄健翔直接点破事实

青杉依旧啊啊
2026-06-30 22:02:13
多位名宿为巴西助阵,里瓦尔多:我们巴西队是不可战胜的

多位名宿为巴西助阵,里瓦尔多:我们巴西队是不可战胜的

懂球帝
2026-06-30 17:13:46
“别让女儿学舞蹈了”,荷花奖得主在酒馆兼职舞女,家长看蒙了

“别让女儿学舞蹈了”,荷花奖得主在酒馆兼职舞女,家长看蒙了

泽泽先生
2026-06-30 19:47:39
4次助攻第1!巴西28岁中场大师崛起:追平济科,辅佐维尼修斯冲冠

4次助攻第1!巴西28岁中场大师崛起:追平济科,辅佐维尼修斯冲冠

李喜林篮球绝杀
2026-06-30 11:52:23
7月1日精选热点:光模块对晶振需求暴增10倍  这2家龙头要暴涨

7月1日精选热点:光模块对晶振需求暴增10倍 这2家龙头要暴涨

元芳说投资
2026-06-30 19:50:30
2026-06-30 23:31:00
极客公园
极客公园
让最棒的创新成为头条
12212文章数 78911关注度
往期回顾 全部

科技要闻

iPhone18 Pro遭泄密!印度代工商惹祸

头条要闻

坎贝尔承认:中国是最成功渡过难关的国家

头条要闻

坎贝尔承认:中国是最成功渡过难关的国家

体育要闻

大热倒灶压力给到法国 王楚揭法国队隐患

娱乐要闻

韩红称要退出公益,多位名人挽留

财经要闻

万亿“寒王”,历史时刻

汽车要闻

奇瑞风云A9探店 五个理由一定来看看

态度原创

本地
游戏
旅游
家居
公开课

本地新闻

贵州小城的新目标:举办“村超”世界杯!

预购开启!索尼限定PS5蓝色手柄官宣8月6日上架

旅游要闻

“跟着诗词游四川”正式启动 六城联袂邀约:从剑门雄关一路“游”到嘉陵碧波

家居要闻

传奇筑 日常诗

公开课

李玫瑾:为什么性格比能力更重要?

无障碍浏览 进入关怀版