Anthropic 于 2026 年 7 月 24 日推出 Claude Opus 5,性能接近 Claude Fable 5,价格仅一半。在 Frontier-Bench、CursorBench 等编程与知识工作基准上创下新 SOTA,成本效率大幅领先上一代 Opus 4.8。
2026 年 7 月 24 日,Anthropic 宣布推出 Claude Opus 5,定位为日常使用的主动推理模型,智能水平接近旗舰 Claude Fable 5,但价格仅为后者一半。新模型已作为 Claude Max 的默认模型,并成为 Claude Pro 上最强可选项。
Claude Opus 5 在编程与知识工作评估中达到新 SOTA:在 Frontier-Bench v0.1 上超越所有其他模型,性能较 Opus 4.8 翻倍以上,且单任务成本更低;在 CursorBench 3.2 最大努力模式下,得分与 Fable 5 相差不到 0.5%,但成本减半。此外,Opus 5 在 ARC-AGI 3 上的得分是次优模型的 3 倍,在 Zapier AutomationBench 中的通过率约为同等成本下其他最佳模型的 1.5 倍,在 OSWorld 2.0 上以不到 Fable 5 三分之一成本超越后者最佳结果。
在科学领域,Opus 5 同样显著优于 Opus 4.8:有机化学任务(如根据光谱数据推断分子结构)得分提高 10.2 个百分点,蛋白质序列-功能预测任务提高 7.7 个百分点。新模型还具备更强的视觉输出能力,如生成风洞气流模拟和细胞交互式插图。
原文链接: https://www.anthropic.com/news/claude-opus-5