Anthropic 发布了最新的 AI 模型 Claude Opus 5.5。距上一次升级 Opus 大约两个月,节奏与以往相近。
Anthropic Claude Opus 5.5
Anthropic 目前在 Claude 系列下提供多款模型。
三款主力分别是 Haiku(最小、最便宜)、Sonnet(中等体量和价格),以及 Opus(三款里最大、最贵的一款)。
还有更强、也更贵的 Fable/Mythos,属于 Anthropic 的最高档。
这次发布把 Claude 的 Opus 从 5 升到了 5.5。
Anthropic 表示:“Opus 5.5 是我们呼吁放缓前沿竞赛之后发布的第一款模型。和以往一样,发布前经过外部评估,包括 METR 和 Frontier Design。在我们最全面的对齐测试上,它拿到了迄今最高分。”
关于 Opus 5.5 的表现,Anthropic 这样说:
Opus 5.5 相对 Opus 5 是一次明显跃升。它成了新的领先模型,早期测试者在最复杂的工作上看到了大幅提升。有人用它在不到一天内完成了 68 万行代码迁移,换作工程团队可能要花数周。它也擅长找出并修复软件里的低效之处:我们让它缩短一款网页应用每一页的加载时间,Opus 5.5 成功了 40 次中的 39 次,而 Opus 5 只做出较小改进,还改动了应用行为。另一位测试者让多款 Claude 模型根据同一条提示做游戏,Opus 5.5 在画面质量和完成度上高于其他模型。
具体到编程,Anthropic 说:
Opus 5.5 特别擅长跨代码库迁移、审计这类又长又散的任务。一位早期测试者用它在不到三小时内审计并修复了 20 万行代码库,Opus 5 则花了超过 20 小时,token 用量是 2.5 倍。内部测试中,我们让 Opus 5.5 和 Fable 5.1 把广泛用于服务器流量负载均衡的 HAProxy 从 C 翻译成 Rust。两份重写几乎都通过了 HAProxy 自带的回归测试,但 Opus 5.5 用了 9.5 小时,Fable 5.1 用了 12 小时,成本还低 51%。
Opus 5.5 在智能体编程上达到前沿水平,成本却低得多。在 FrontierCode 的默认努力程度下,它优于 GPT-6 Astra,单任务成本大约只有后者的 20%。在 Terminal Bench 4.0 上,它与 Astra 持平,成本约为 40%;在 CursorBench 上,它比 GPT-5.6 Sol 高出 11 分,成本大约只有三分之一。
价格也相对 Opus 5 做了调整:
Opus 5.5 的服务算力需求低于 Opus 5,定价也体现了这一点。测试显示,默认设置下,典型工作负载成本比 Opus 5 低 40%。输入和输出 token 分别为每百万 4 美元和 20 美元,比 Opus 5 低 20%。缓存读取(智能体和编程工作成本的大头)为每百万 token 0.20 美元,比 Opus 5 低 60%。Opus 5.5 的输出速度也比 Opus 5 快 30% 以上。
降价之外,我们还提高了 Pro、Max 和 Team 套餐的五小时用量上限。订阅用户还会获得一次速率限制重置,可以自行保存,随时使用。
新的 Claude Opus 5.5 现已可用。接下来,Anthropic 表示 Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周推出,并带来许多同样的性能、效率和安全改进。
关于新 Claude Opus 5.5,你可以在这里了解更多。
把苹果产品用得更顺手
AirPods 5 | 苹果最新无线耳机
Apple AirTag 2 | 给钥匙、包、自行车等加上“查找”追踪
AirPods Pro 3 | 苹果目前最好的无线耳机
无线 CarPlay 转接器 | 不用再插线
Beats USB-A 转 USB-C 线 | 官方 CarPlay 线缆

















