
定价与性能:高性价比对标竞品
在定价方面,Opus 5 的输入和输出价格统一为每百万代币 2.5 美元。相比之下,Fable 5 的定价为输入每百万代币 10 美元、输出每百万代币 50 美元;OpenAI 的 GPT-5.6 Sol 模型则为输入 5 美元、输出 30 美元。
尽管单价大幅降低,但评估实际成本还需考虑完成同一任务所需的代币数量。据 Artificial Analysis 数据显示,在 " 智能指数 " 任务中,各模型的加权平均成本分别为:Fable 5 为 2.75 美元,Opus 5(最大规格)为 2.03 美元,GPT-5.6 Sol(最大规格)为 1.04 美元,Kimi K3 为 0.95 美元。在智能指数得分上,Opus 5 以 61 分领先,仅比 Fable 5 高出 1 分。Anthropic 表示,Opus 5 在保持与前代 Opus 4.8 相同成本的前提下,实现了性能的大幅提升。
技术优化:上下文扩容与回复风格调整
通过对系统提示词进行精简,Opus 5 为用户留出了更多的上下文空间。Claude Code 工程师 Thariq Shihipar 透露,Anthropic 在新模型中移除了 80% 的 Claude Code 系统提示词内容。他建议开发者在编写提示词、技能指令及 CLAUDE.md 文件时同步进行简化,并可利用 `claude doctor` 命令辅助优化。
值得注意的是,Opus 5 的默认回复长度较前代模型有所增加。Anthropic 警告称,若用户不希望出现这种冗长风格,需在提示词中明确要求控制回复长度,否则可能面临更高的费用支出。
安全与应用:降低拒绝率,增强企业友好度
在开源代码漏洞挖掘方面,Opus 5 表现强劲。在 OSS-Fuzz 基准测试中,其得分为 80%,略高于 Mythos 模型的 79.4%。然而,在漏洞武器化利用方面,Opus 5 明显较弱:14 次尝试中仅成功 4 次,而 Mythos 的成功率高达 13/14。
系统卡片显示,Opus 5 在代理编程、计算机使用和长周期知识工作领域的提升最为显著,整体性能可与 Fable 5 媲美,部分场景下甚至超越 Fable 5 及 Claude Mythos 5。由于网络分类器限制比例低于 Fable 5,Opus 5 在网络安全和生物学任务中的拒绝率大幅降低,允许查找源代码漏洞,但仍会阻止基于二进制的漏洞扫描、渗透测试及漏洞利用生成。
为解决模型拒绝服务带来的困扰,Anthropic 在 API 中引入了自动回退功能。当请求被判定为过于危险而不适合由 Opus 5 或 Fable 5 处理时,系统将自动将其路由至能力较弱的其他模型,而非直接阻断。官方称,Opus 5 是 Anthropic 迄今为止 " 对齐度最高 " 的模型,最难突破安全护栏。此外,该模型支持无数据保留模式,进一步提升了其对 enterprise 客户的吸引力。
【星途科讯 图文丨 LCC 首发于 ZAKER 科技,转载请注明出处】