Anthropic的Opus 5关注的是token效率,而不是能力的飞跃
Ars Technica2026年7月24日 21:05
今天,Anthropic推出了Opus 5,这是该模型的最新更新,最近在编码和其他软件开发任务中成为了一个热门选择。虽然这对Opus来说是一个显著的提升,但似乎并不是Opus 4.5级别的代理编码性能突破。一张由Anthropic制作的图表显示,Opus 5在Frontier-Bench和DeepSWE等各种基准测试中表现大致相同或略优于Anthropic的Fable模型在编码任务中的备受瞩目的能力。它在几乎所有类型的任务中都胜过Opus 4.8和OpenAI的竞争对手GPT-5.6-Sol。这些基准测试显示出性能的逐步提升,而不是根本性的飞跃,主要宣传点是它是一个以大约一半成本提供接近Fable能力的模型。值得一提的是,Anthropic特别避免对Opus 5进行网络安全任务的前沿训练,因此在这方面远远落后于Fable和Mythos。Anthropic声称其在发现网络安全漏洞方面相对不错,但由于训练模型时做出的决策,它在利用这些漏洞方面“在很大程度上落后于Mythos 5”。因此,Opus 5并没有完全包含Fable所具备的所有有争议的保护措施,例如在事件发生时保留数据以供审查30天的政策。
本站免费、广告极少。如果觉得有帮助,可以请我们喝杯咖啡 —— 任何金额都对持续运营有实际帮助。
☕请我喝杯咖啡