Anthropic正式发布Claude Opus 5人工智能模型。官方宣称,该模型在智能水平接近前沿标准的同时,成本仅为Claude Fable 5的一半。对于深受代币(token)成本高企困扰的企业用户而言,这一降价策略极具吸引力。
定价与性能:高性价比对标竞品
在定价方面,Opus 5的输入和输出价格统一为每百万代币2.5美元。相比之下,Fable 5的定价为输入每百万代币10美元、输出每百万代币50美元;OpenAI的GPT-5.6 Sol模型则为输入5美元、输出30美元。
尽管单价大幅降低,但评估实际成本还需考虑完成同一任务所需的代币数量。据Artificial Analysis数据显示,在“智能指数”任务中,各模型的加权平均成本分别为:Fable 5为2.75美元,Opus 5(最大规格)为2.03美元,GPT-5.6 Sol(最大规格)为1.04美元,Kimi K3为0.95美元。在智能指数得分上,Opus 5以61分领先,仅比Fable 5高出1分。Anthropic表示,Opus 5在保持与前代Opus 4.8相同成本的前提下,实现了性能的大幅提升。
技术优化:上下文扩容与回复风格调整
通过对系统提示词进行精简,Opus 5为用户留出了更多的上下文空间。Claude Code工程师Thariq Shihipar透露,Anthropic在新模型中移除了80%的Claude Code系统提示词内容。他建议开发者在编写提示词、技能指令及CLAUDE.md文件时同步进行简化,并可利用`claude doctor`命令辅助优化。
值得注意的是,Opus 5的默认回复长度较前代模型有所增加。Anthropic警告称,若用户不希望出现这种冗长风格,需在提示词中明确要求控制回复长度,否则可能面临更高的费用支出。
安全与应用:降低拒绝率,增强企业友好度
在开源代码漏洞挖掘方面,Opus 5表现强劲。在OSS-Fuzz基准测试中,其得分为80%,略高于Mythos模型的79.4%。然而,在漏洞武器化利用方面,Opus 5明显较弱:14次尝试中仅成功4次,而Mythos的成功率高达13/14。
系统卡片显示,Opus 5在代理编程、计算机使用和长周期知识工作领域的提升最为显著,整体性能可与Fable 5媲美,部分场景下甚至超越Fable 5及Claude Mythos 5。由于网络分类器限制比例低于Fable 5,Opus 5在网络安全和生物学任务中的拒绝率大幅降低,允许查找源代码漏洞,但仍会阻止基于二进制的漏洞扫描、渗透测试及漏洞利用生成。
为解决模型拒绝服务带来的困扰,Anthropic在API中引入了自动回退功能。当请求被判定为过于危险而不适合由Opus 5或Fable 5处理时,系统将自动将其路由至能力较弱的其他模型,而非直接阻断。官方称,Opus 5是Anthropic迄今为止“对齐度最高”的模型,最难突破安全护栏。此外,该模型支持无数据保留模式,进一步提升了其对 enterprise 客户的吸引力。
【星途科讯 图文丨LCC 首发于ZAKER科技,转载请注明出处】