新版Claude更快更便宜,一天干完团队数周活
Anthropic发布了新一代旗舰模型Claude Opus 5.5。Claude家族分三档。Haiku最小最便宜,Sonnet中等,Opus最大也最贵。之上还有更高级的Fable/Mythos,是Anthropic的最高档。Opus 5.5在大多数任务上表现与Fable 5.1相当。运行成本比Opus 5低了40%。
这是Anthropic呼吁“放缓前沿”之后发布的第一个模型。发布前经过了包括METR和Frontier Design在内的外部评估者测试。Anthropic说,Opus 5.5在它最全面的对齐测试中拿了迄今最高分。具体数字没有给。
价格与速度
Anthropic算了一笔成本账。默认设置下,Opus 5.5在典型工作负载上的成本比Opus 5低40%。输入和输出token分别为每百万4美元和20美元,比Opus 5低20%。缓存读取降到每百万0.20美元,比Opus 5低60%。缓存读取是智能体和编程类工作成本里的大头。输出速度比Opus 5快了30%以上。
这个成本优势,Anthropic直接放到了与对手的对比里。在FrontierCode上,Opus 5.5击败了GPT-6 Astra。每任务成本约为对手的20%。在Terminal Bench 4.0上,以约40%的成本与Astra打平。在CursorBench上,以约三分之一成本领先GPT-5.6 Sol 11分。
实测表现
一位早期测试者用Opus 5.5迁移了一个680,000行的代码库。整个过程不到一天,原本要一个工程团队干几周。另一位测试者用它审计并修复了一个200,000行的代码库,用时不到3小时。同样的活,Opus 5花了超过20小时。token用量是Opus 5.5的2.5倍。
Anthropic内部测试把HAProxy从C语言翻译成Rust。Opus 5.5用了9.5小时,Fable 5.1用了12小时,成本低51%。两次重写都通过了HAProxy几乎全部的回归测试。
在网页加载时间优化测试中,Opus 5.5在40次尝试里成功了39次。Opus 5只做出了较小的改进,还改变了应用行为。在从单一提示构建游戏的测试里,Opus 5.5图形和润色得分高于其他模型。
订阅用户受益
价格下调之外,Anthropic还做了两件事。一是提高Pro、Max和Team计划的五小时使用限制。二是给订阅用户加了一个速率限制重置功能,能存起来,需要时再用。
接下来几周,Claude Sonnet 5.5和Haiku 5.5也会发布。Anthropic称,它们会带来类似的性能、效率和安全性改进。
不过有两件事Anthropic没说明。一是定价调整会不会影响API用户现有的合同或计费方式。二是Opus 5.5在写作、分析等非编程任务上的表现数据,这次也没给。