7月24日,Anthropic 正式发布 Claude Opus 5。官方将其定位为适合日常高难度工作的高性能模型,重点提升软件工程、知识工作、复杂问题求解以及长时间运行的智能体任务。
Claude Opus 5 已成为 Claude Max 的默认模型,也是 Claude Pro 用户可用的最强模型。API 价格保持与 Opus 4.8 一致:每百万输入 Token 5美元、每百万输出 Token 25美元。开发者还可以通过 effort 设置,在推理能力、速度和 Token 消耗之间进行取舍。
据 Anthropic 公布的内部与合作评测,Opus 5 在 Frontier-Bench、CursorBench、OSWorld 2.0 等编程和计算机操作测试中取得明显提升;在 ARC-AGI 3 新问题求解评测中,成绩达到下一名模型的约3倍。上述结果主要来自公司披露,实际表现仍会随任务、工具链和提示方式而变化。
安全方面,Anthropic 称 Opus 5 在部署前行为审计中表现出更低的欺骗和高风险行为比例。模型保留了针对渗透测试、漏洞利用生成等高风险网络安全请求的限制,并可在触发安全分类器时回退到其他模型。
© 版权声明
本站文章版权归AI工具分享所有,未经允许禁止任何形式的转载。
桂公网安备45132202000164号