Anthropic发布Claude Opus 5.5,成本降四成
「Anthropic推出Claude 5.5系列首款模型Claude Opus 5.5,多数任务上达到Claude Fable 5.1的水平,典型工作负载成本比Opus 5低40%,缓存读取价格降低60%,输出速度提升超30%,并在自动化行为审计中取得迄今最佳成绩。」
Anthropic正式发布Claude Opus 5.5,这是全新Claude 5.5系列的第一款模型。官方给出的定位相当明确:它在大多数工作任务上能够达到Claude Fable 5.1的水平,而运行成本比上一代Opus 5降低了40%。对于每天要跑大量智能体与编码任务的开发者而言,这既是一次能力升级,也是一次成本结构的重写。
性能方面,Claude Opus 5.5相较Opus 5是一次大幅跃升,并成为新的领先模型。早期测试者反馈,他们在最复杂的工作上看到了明显的性能提升。其中一位测试者在不到一天的时间里完成了68万行的代码迁移,而这项工作在过去通常需要一个工程团队花费数周时间。这类长链路、跨文件的重构任务,正是衡量模型实际生产力的关键场景。
在修复软件低效问题上,Claude Opus 5.5的表现同样突出。当研究人员要求它压缩一个Web应用所有页面的加载时间时,它在40次尝试中成功了39次;相比之下,Opus 5虽然也带来了小幅改进,却同时改变了应用本身的行为。另一位测试者让多个Claude模型根据同一条提示构建游戏,Claude Opus 5.5在画面质量和整体打磨程度上得分高于其他任何模型。
安全与对齐是这次发布的另一条主线。在Anthropic自有的自动化行为审计这一套覆盖数千个模拟场景的对齐测试中,Claude Opus 5.5取得了迄今所有模型中的最佳分数。它比近期发布的模型更不容易采取难以撤销的行动,也更少越出被给定的边界,同时在抵御提示注入方面比Opus 5更强。Anthropic还扩展了对齐测试的覆盖面,将更长任务、不可能完成的任务以及基于真实事件建模的场景纳入其中,不过官方也承认该模型仍然存在局限。发布之前,模型由外部评估机构进行测试,其中包括Frontier Design和METR,完整评估细节收录在Opus 5.5系统卡中。
成本与速度的改进直接体现在定价上。由于Claude Opus 5.5在服务时所需的算力少于Opus 5,其价格也相应下调。官方测试显示,在默认设置下处理典型工作负载时,它的成本比Opus 5低40%。具体价格为:输入每百万Token 4美元,输出每百万Token 20美元,均比Opus 5低20%。缓存读取价格为每百万Token 0.20美元,比Opus 5低60%,而缓存读取恰恰构成了智能体与编码类工作成本的大头。此外,Claude Opus 5.5的输出生成速度比Opus 5快30%以上。
除了降价,Anthropic还提高了Pro、Max和Team计划的五小时用量上限,并向订阅用户提供速率限制重置,且该重置额度现在可以保存下来留待后续使用。对于依赖长时窗口连续跑任务的开发者来说,这些额度调整与价格下调叠加,会显著改变单位任务的实际开销。
在能力边界与部署策略上,由于Claude Opus 5.5在生物学和网络安全领域的能力与Claude Mythos 5.1相当,Anthropic为它配备了与Claude Fable 5.1类似的保护措施。经过审核的机构可以从今天起申请生命科学验证计划,将Opus 5.5用于生物学研究;未来几周内,网络验证计划的访问权限也将扩大,通过验证的网络安全从业者可以使用Opus 5.5开展工作。整体来看,Claude Opus 5.5在性能、安全与成本三个维度上同时推进,其定价与速度表现可能比单纯的分数提升更值得开发者关注。
来源:Heooo AI工具导航