Claude Opus5.5发布:成本降40%、提速30% 封面图
行业资讯

Claude Opus5.5发布:成本降40%、提速30%

Heooo 09月23日15时36分 38 阅读

「Anthropic发布Claude5.5系列首款模型Opus5.5,默认设置下典型任务成本较上代降低40%,输出速度提升超30%。9项测试中7项领先Fable5.1、Opus5与GPT-6Astra,三项编程测试均列第一,Artificial Analysis Intelligence榜单以58分登顶,Token价格同步下调20%。」

Anthropic正式发布Claude5.5系列的首款模型Opus5.5,官方称其在多数任务上的表现与Fable5.1相当,但在默认设置下典型任务的成本较上代Opus5降低40%,输出速度提升超过30%。该模型已同步上线Claude应用,并通过亚马逊云科技、谷歌云与微软Azure对外提供服务。

在官方公布的9项基准测试中,Opus5.5有7项领先Fable5.1、Opus5以及OpenAI的GPT-6Astra和GPT-5.6Sol。三项编程测试均拿下最高分:Terminal-Bench4.0达到66.4%,FrontierCode v1.1为54.4%,CursorBench4.0为57.8%。不过在业务流程与科研Agent测试中,它仍落后于GPT-6Astra。在Artificial Analysis Intelligence榜单上,Opus5.5以58分位列第一,领先Fable5.1与GPT-6Astra的53分。

Claude Opus5.5发布:成本降40%、提速30%

长任务表现是本次升级的重点。内部测试中,Opus5.5用9.5小时完成了负载均衡软件HAProxy从C语言到Rust的改写,成本较Fable5.1低51%。在需要逐一核对数字与引语的财报研究测试里,其生成的18份报告有16份达标,而Fable5.1与Opus5均未通过。有早期测试者表示,不到一天就完成了涉及68万行代码的迁移,这类原本高度依赖人力的长链路工作,正是模型能力释放的关键场景。

价格方面,每百万输入与输出Token分别收费4美元和20美元,较Opus5下降20%,缓存读取费用下降60%;Pro、Max等套餐的五小时使用额度同步提高,订阅用户还额外获得一次限额重置机会。对需要大规模调用模型跑Agent流程的开发者而言,成本下降与上下文缓存降价带来的实际收益,往往比单点跑分更值得关注。

安全层面,Opus5.5尝试绕过隔离边界的频率较Opus5降低约85%,并且会自行报告相关行为;提示词注入防御与Fable5.1并列成为受测模型中成功率最低的一档。不过大多数网络安全任务仍会转交Opus4.8处理,官方也承认部署前评估无法发现所有失效情况。这种把高风险能力留在旧模型、把通用能力前移的分层思路,正在被更多厂商采用。

发布近2小时后,OpenAI便推出GPT-6Sol与Luna;Sonnet5.5与Haiku5.5计划在未来几周上线。以效率与成本压缩换取Agent规模化落地,正在成为头部模型竞争的主线,而模型家族内部的版本分层与任务分流,也将成为开发者选型时需要重点权衡的因素。

# Anthropic # Claude Opus5.5 # 大模型评测 # AI Agent

来源:Heooo AI工具导航