Folia
← 返回头版

Claude Opus 5发布,性能大幅提升价格保持不变

Anthropic推出了Claude Opus 5大模型1。新模型相比前代Opus 4.8实现了显著的性能提升,同时维持原有价格——输入令牌$5/百万,输出令牌$25/百万1。

Claude Opus 5在多个权威评估基准上实现了业界领先成绩1。在Frontier-Bench v0.1评估中,其性能相比Opus 4.8提升一倍以上1。在ARC-AGI 3评估上,该模型的得分达到次优模型的三倍1。在计算机使用能力方面,Claude Opus 5在OSWorld 2.0基准上以仅Fable 5成本三分之一的价格超越了后者的最佳成绩1。在Zapier AutomationBench上的通过率约为次优模型的1.5倍1。

在代码编程和科学研究领域表现尤为突出1。软件工程任务中的性能翻倍提升1,有机化学任务上较Opus 4.8提高10.2个百分点,蛋白质相关任务上提高7.7个百分点1。在CursorBench 3.2最大努力设置下,该模型性能接近Fable 5峰值成绩,但成本仅为一半1。

新模型已上线所有平台,成为Claude Max的默认模型和Claude Pro的最强选择1。用户可选择Fast模式,其运行速度约为默认速度的2.5倍,但价格为基础价格的两倍1。此外,Claude Opus 5在自动行为审计中被评为目前最对齐的模型,欺骗行为率最低1。

在某些专业领域,该模型仍存在差距1。生物学研究和网络安全方面的性能仍落后于Mythos 51。


来源

  1. Hacker NewsClaude Opus 5

评论