9月23日,Anthropic 正式推出 Claude Opus 5.5 模型。这是 Claude 5.5 家族的首款产品,官方称其在多数工作任务上的表现可与 Claude Fable 5.1 相媲美,而运行成本较 Opus 5 降低了 40%。
Claude Opus 5.5 的具体改进如下:
性能上,Opus 5.5 较 Opus 5 有明显跃升。官方表示,早期测试者在处理最复杂任务时感受到了大幅度的性能提升。有测试人员用不到一天时间完成了 68 万行代码迁移,而这类任务原本需要数周。Opus 5.5 还擅长识别并修复软件中的低效环节——在官方要求其缩短网页应用每个页面的加载时间时,Opus 5.5 在 40 次尝试中成功了 39 次;相比之下,Opus 5 只做了少量改进,还改变了应用的行为。另一位测试者让多个 Claude 模型依据同一提示构建游戏,Opus 5.5 在画面和精致度上获得的评分高于其他所有模型。
安全方面,Opus 5.5 在 Anthropic 的自动化行为审计中拿下了迄今所有模型的最高分。该审计套件在数千个模拟场景中对 Claude 进行测试。Opus 5.5 采取不可逆行动或越出既定边界的概率低于其他近期发布的模型,并且在抵抗提示注入方面也强于 Opus 5。官方还扩大了对齐测试的覆盖范围,纳入了更长任务、不可能完成的任务以及基于真实事件的场景。
由于 Opus 5.5 在生物学和网络安全领域的表现与 Claude Mythos 5.1 相当,官方在部署时采用了类似 Claude Fable 5.1 的防护措施。经过审核的机构即日起可申请生命科学验证项目,使用 Opus 5.5 开展生物学研究。未来几周,Anthropic 还将扩大网络验证项目的准入范围,获得认证的网络安全从业者将可以使用 Opus 5.5 进行工作。
成本与速度方面,Opus 5.5 所需计算量少于 Opus 5,定价也相应调整。官方测试表明,在默认设置下,Opus 5.5 处理典型工作负载的成本比 Opus 5 低 40%。同时,Opus 5.5 的输出速度比 Opus 5 快 30% 以上。
输入和输出 Token 的价格分别为 4 美元 / 百万 Token 和 20 美元 / 百万 Token,较 Opus 5 低 20%。
缓存命中的价格为 0.20 美元 / 百万 Token,比 Opus 5 低 60%。
除降价之外,Anthropic 还放宽了 Pro、Max、Team 等企业套餐的使用时间限制,并为订阅用户提供速率限制重置功能,客户现在可以随时保存和使用。
沟通交流能力上,Opus 5.5 的表达比此前模型更为自然。早期测试者反馈其文字更清晰易懂,能将最重要的信息置于最前,在长时间训练中成为更佳的工作伙伴。正如一位早期测试者所言:“它的写作方式和我一样。”
Claude Sonnet 5.5 和 Claude Haiku 5.5 将在未来几周内推出,在性能、效率和安全性方面也将包含许多相同的改进。
在 Anthropic 官方的基准测试中,Claude Opus 5.5 在智能编码、计算机使用和知识工作方面保持领先。















