← 返回行业咨询

Anthropic发布Claude Opus 5:性能对标Fable 5,价格减半

Anthropic发布Claude Opus 5:性能对标Fable 5,价格减半

在人工智能模型竞争日趋白热化的当下,Anthropic近日正式发布了其最新一代旗舰大模型——Claude Opus 5。这款新模型不仅在编程、科研等硬核能力上刷新了多项纪录,更以极具竞争力的定价策略和前所未有的安全对齐标准,重新定义了高端AI模型的市场格局。

一、 重新定义旗舰:从“最强”到“最稳”

Claude Opus 5此次上线,直接取代前代成为 Claude Max 的默认模型,同时也是 Claude Pro 用户可用的最强模型选择。与以往单纯追求参数规模或绝对性能不同,Anthropic将Opus 5定位为一款“更具主动性”且“更审慎”的模型。

这意味着,用户在享受顶级算力的同时,不再需要像过去那样在“高性能”与“高成本”之间做单选题,也不必在“高智能”与“高安全性”之间走钢丝。

二、 性能炸裂:多项基准测试领跑

根据Anthropic官方披露的数据,Claude Opus 5的智能水平已逼近其最新推出的 Claude Fable 5,但在价格上仅为后者的一半。这一性价比优势在以下关键领域体现得淋漓尽致:

1. 编程能力的降维打击

对于开发者而言,Opus 5堪称利器。在 Frontier-Bench v0.1 测试中,其得分达到前代Opus 4.8的两倍以上,远超所有竞争对手。而在备受瞩目的 CursorBench 3.2 中,即便在最高努力档位下,Opus 5与Fable 5的峰值成绩差距也仅为 0.5%

更令人印象深刻的是其成本效率:在high、xhigh和max三个档位上,同等成本下的表现,Opus 5领先所有其他模型。

2. 知识工作与问题解决

在处理端到端商业任务时,Opus 5在 Zapier AutomationBench 上的通过率约为次优模型的 1.5倍(按单任务成本计算)。在考察解决全新问题的 ARC-AGI 3 基准中,其得分更是高达第二名的 三倍。此外,在计算机操作基准 OSWorld 2.0 中,它以约 三分之一 的成本超越了Fable 5的最佳成绩。

3. 科研能力的深度突破

在生命科学领域,Opus 5在结构生物学、有机化学和生物信息学等方向均优于前代。特别是在有机化学方面,根据波谱数据推断分子结构的内部基准测试中,其准确率比前代高出 10.2个百分点;在预测序列变异如何影响蛋白功能的评测中,提升了 7.7个百分点

三、 自主性与安全性的完美平衡

Opus 5最引人注目的特性之一,是其强大的自主工作能力与极高的安全标准之间的平衡。

1. 惊人的自主性

Opus 5擅长自我核查并持续迭代直到成功。例如,在缺乏直接查看图纸的情况下,它自行编写计算机视觉流水线重建了三维机械零件,而竞品在此类尝试中五次均告失败。它还曾独立找到某开源软件包管理器的真实漏洞根本原因,修复了社区补丁遗漏的极端情况,甚至在一次会话中为新交易所构建市场数据源并自行搭建测试框架验证代码。

2. “迄今对齐程度最高”

Anthropic宣称,Opus 5是该公司“迄今对齐程度最高的模型”。行为审计显示,其对Claude宪章的遵循度超过Opus 4.8、Sonnet 5和Fable 5,欺骗行为发生率最低,最难被诱导滥用。在自动化行为审计中,其整体不协调行为得分仅为 2.3,为近期推出模型中最低。

3. 刻意的安全限制

值得注意的是,Opus 5在生物研究和进攻性网络安全方向上故意落后于Mythos 5。团队明确表示未针对网络任务训练该模型,且在OSS-Fuzz评测中,虽然识别软件漏洞成功率与Mythos 5相近,但在开发针对漏洞的攻击程序方面远不如后者。这种“有所为有所不为”的策略,反映了Anthropic在通用人工智能能力与风险控制之间的审慎考量。

四、 极具竞争力的定价与实用功能

1. 定价策略

即日起,Claude Opus 5在所有平台上线,定价与前代持平,仅为Fable 5的一半,略低于OpenAI GPT-5.6:
* 输入价格:$5 / 百万 token
* 输出价格:$25 / 百万 token

2. 新功能亮点

  • 努力程度调节:用户可自由权衡性能与成本,调高获得更强智能,调低则更快、更省token。
  • 极速模式(Fast mode):处于研究预览阶段,以两倍的价格提供约2.5倍的默认速度。
  • 自动回退机制:当安全分类器拦截Opus 5或Fable 5请求时,系统会自动路由到其他可用模型,确保服务连续性。
  • 工具更换:Claude平台支持对话中途更换工具而不使提示缓存失效(测试版),大幅提升API调用效率。

结语

Claude Opus 5的发布,标志着Anthropic在追求高性能模型的同时,进一步强调了性价比安全性的平衡。通过大幅降低编程和知识工作任务的成本,并在保持极高安全对齐标准的前提下提升自主性,Opus 5旨在成为高频日常使用和复杂科研任务的首选模型。

然而,其在进攻性网络安全和长时程生物研究方面的刻意限制,也提醒我们:在通往通用人工智能的道路上,速度固然重要,但方向与安全同样关键。


参考链接
* https://www.anthropic.com/news/claude-opus-5
* https://www.theverge.com/ai-artificial-intelligence/970105/claude-opus-5-announced-anthropic-ai-model-release