HeadlinesBriefing favicon HeadlinesBriefing.com

Claude Opus 5.5 推出 成本降40%

Hacker News •
×

我们推出全新的Claude Opus 5.5,这是Claude 5.5系列的首款模型。它在大多数工作任务上表现出与Claude Fable 5.1相当的水平,并且相比Opus 5运行成本降低40%。Claude Opus 5.5是我们自呼吁控制前沿进展以来首次发布的模型。它在发布前由外部评估机构进行测试,包括Frontier Design和MET R。在我们自动化的行为审计测试中——这是我们最全面的对齐测试——Opus 5.5是迄今为止表现最强的模型。它还附带了我们为最具潜力的模型开发的安全措施。

Opus 5.5是从Opus 5提升而来。一名测试者在不到一天的时间内完成了68万行代码的迁移——这项工作原本需要由工程团队工作数周。当被要求缩短Web应用每页的加载时间时,Opus 5.5在40次尝试中成功了39次,而Opus 5只做了较小的改进,同时也改变了应用的行为。另一位测试者让多个Claude模型仅凭一个提示就构建了一个游戏;Opus 5.5在图形和打磨程度方面得分高于任何其他模型。

Opus 5.5在自动化行为审计测试中取得了迄今为止最好的成绩。与最近的模型相比,Opus 5.5更不太可能采取难以逆转的行动或超出其赋予的边界行动,并且比Opus 5在抵御提示注入方面更强。它在生物学和网络安全领域的表现相当于Claude Mythos 5.1,因此我们将部署类似于Claude Fable 5.1的安全措施。经过筛选的组织可以今天申请我们生命科学验证计划,以便在生物学研究中使用Opus 5.5。

Opus 5.5比Opus 5在服务时需要的计算资源更少,输入和输出token分别为每百万美元4美元和20美元——比Opus 5低20%。缓存读取费用为每百万token 0.20美元,比Opus 5低60%。Opus 5.5还能比Opus 5生成输出速度快超过30%。我们正在提高Pro、Max、Team以及基于座位的企业计划的五小时使用限制。Claude Sonnet 5.5和Claude Haiku 5.5将在接下来的几周内推出。