Anthropic 发布 Claude Opus 5:以 Opus 4.8 的成本逼近前沿智能
2026 年 7 月 24 日,Anthropic 正式推出 Claude Opus 5。它的核心卖点非常直接:定价与上一代 Opus 4.8 完全相同(输入 $5、输出 $25 每百万 Token),但性能大幅提升,在编程和知识工作多项基准上刷新行业纪录,整体能力逼近更高级别的 Claude Fable 5——换句话说,你可以用约一半的价格拿到接近前沿的智能。对正在为网站、SaaS 或智能体应用选型的团队,这是一个需要认真评估的选项。
同等成本下的性能跃升
Opus 5 的进步最直观地体现在软件工程任务上。在 Frontier-Bench v0.1 中,Opus 5 超越所有其它模型,并且每任务成本低于 Opus 4.8 的一半,性能却翻了一倍以上。在 CursorBench 3.2 上,开启 max 推理强度后,它达到 Fable 5 峰值分数的 99.5%,而每任务成本仅为后者的一半。
知识工作方面同样亮眼:
- 在考察新颖问题求解的 ARC-AGI 3 上,Opus 5 的得分是最接近对手的三倍;
- 在衡量端到端业务任务完成的 Zapier AutomationBench 上,相同每任务成本下的通过率约为次优模型的 1.5 倍,即使使用最低推理档位,完成的业务任务也多于其它任何模型;
- 在计算机使用基准 OSWorld 2.0 上,任意成本点下均优于其它模型,以略高于三分之一的成本超越了 Fable 5 的最佳成绩。
更会"较真"的智能体
Opus 5 在"验证自己的工作、反复迭代直到成功"方面明显更强。Anthropic 分享了不少案例:在一个需要把机械零件图纸重建为 3D FreeCAD 模型的 Frontier-Bench 任务中,Opus 5 被故意不给直接查看图纸的路径,它干脆自己编写了一条计算机视觉管线,从原始像素中提取几何信息并成功重建——同样配置下的竞品尝试五次均未成功。
这种自主性对长周期工作很有价值。Zapier CEO Wade Foster 提到,Opus 5 拿到一份原始账户健康度工作表后,端到端跑完了完整的流失预警流程:标记风险账户、通知负责人、为留存运营生成总结,此前模型都没有通过,Opus 5 拿到了 100% 通过率。对自动化工作流而言,这意味着更少的失败重试和更少的人工介入。
对齐与安全策略
Anthropic 表示,Opus 5 是"迄今为止最对齐的模型":它比 Opus 4.8、Sonnet 5 和 Fable 5 更符合 Claude 宪章,欺骗行为率最低,最不容易被诱导滥用,在避免难以逆转的高风险行为方面也是最安全的。在生物与网络安全的双重用途能力评估中,Opus 5 没有推进前沿风险能力,仍落后于 Mythos 5。
安全护栏方面,Opus 5 的网络安全分类器比 Fable 5 宽松约 85%,允许在源代码中查找漏洞,但阻止二进制级漏洞扫描、渗透测试和漏洞利用生成;被拦截的请求默认回退到 Opus 4.8。配合新的 API 自动回退功能和对话中工具变更(不会使提示词缓存失效),企业可以在保持安全的同时获得更好的可用性。
可用性与集成
Opus 5 已在所有平台上线,成为 Claude Max 的默认模型、Claude Pro 上最强的模型,API 模型名为 claude-opus-5。它还提供 Fast 模式,运行速度约为默认的 2.5 倍,价格为基础价的 2 倍,适合延迟敏感场景。对开发者,Anthropic 还发布了两个测试版功能:对话中工具变更(无需失效提示词缓存即可切换可用工具)和 API 自动回退(被安全分类器标记的请求自动路由到其它模型)。
如果你正在考虑把 Opus 5 接入业务,建议先结合模型微调与模型部署的实践,在自己的真实数据上跑一轮评估,再决定把它放在哪个层级的工作流里。
价格与档位速查
把数字放在一张表里更直观:
| 模型 | 输入价(每百万 token) | 输出价(每百万 token) | 备注 |
|---|---|---|---|
| Opus 4.8 | $5 | $25 | 上一代旗舰 |
| Opus 5 | $5 | $25 | 同价,性能大幅提升 |
| Opus 5 Fast | $10 | $50 | 约 2.5 倍速度 |
| Fable 5 | $10 | $50 | 更高档旗舰 |
对延迟敏感的交互场景(比如客服对话里的流式回答),Fast 模式多花一倍的 token 费用换 2.5 倍速度通常值得;批处理任务则用默认档即可。
一个最小接入示例
开发者可以直接用 claude-opus-5 这个模型名调用:
curl https://api.anthropic.com/v1/messages \
-H "x-api-key: $ANTHROPIC_API_KEY" \
-H "anthropic-version: 2023-06-01" \
-H "content-type: application/json" \
-d '{
"model": "claude-opus-5",
"max_tokens": 1024,
"messages": [{"role": "user", "content": "给这个页面写一个 FAQ 结构"}]
}'
正式接入前,建议把 Opus 5 和当前在用的模型放在同一批真实任务里做一次并排评估,别只信基准分——评估方法可以参考模型评测。
参考:Anthropic API 文档 https://docs.anthropic.com/en/api/messages
16IDC 观察
Claude Opus 5 传递的信号和 GPT-5.6 类似:头部模型厂商都在从"堆能力"转向"抠成本"。Opus 5 用上一代的价格提供了接近旗舰的能力,等于把"前沿智能"的准入门槛又往下拉了一截。对中小团队和独立站而言,这意味着可以用更低的 API 成本获得接近顶级的编码与智能体能力,选择空间明显变大。