Anthropic于2026年7月24日正式发布Claude Opus 5大模型,官方定位为"用一半的价格提供接近前沿智能(comes close to the frontier intelligence of Claude Fable 5 at half the price)"。作为Claude Max的新默认模型,它也是Claude Pro中能力最强的模型,可通过Claude.ai、Anthropic API、Amazon Bedrock、Google Vertex AI、Microsoft Azure AI Foundry等渠道访问。
基准表现:Frontier-Bench与ARC-AGI领跑
据Anthropic官方披露,Claude Opus 5在Frontier-Bench v0.1上得分超过所有其他模型;在ARC-AGI 3这一强调抽象推理的基准上,其得分达到次优模型的三倍;在CursorBench 3.2场景下,max effort模式下性能逼近Claude Fable 5峰值(差距在0.5%以内),但每任务成本仅为后者一半。这种"性能逼近、成本减半"的组合,正是本轮模型投放的算法与成本策略核心。
8月旗舰大模型竞争格局
Claude Opus 5发布后,8月的模型战场持续升温:DeepSeek-V4-Flash官方正式版(0731)于7月31日进入public beta,并在Terminal Bench 2.1等Agent基准上跑出82.7等官方成绩;xAI在8月12日发布可运行长任务Agent的Grok 4.6。各厂商在"更强智能与更低推理成本"上的拉锯,将贯穿整个下半年。
对企业模型选型的启示
对企业而言,Claude Opus 5带来的最大变量是"成本性能比"的再平衡——在复杂推理与编码场景,原先需要挤压预算的前沿能力如今可更轻易落地。建议团队围绕业务专属基准(而非营销指标)做A/B验证,再决定主力模型与回退组合。