Claude Opus5.5内测泄露,百万Token价格腰斩
「Anthropic下一代旗舰Claude Opus5.5疑似内测泄露,版本号跳过5.2直接跳级,代号claude-wafer-eap。流出定价显示每百万Token输入4美元、输出20美元,较Opus5降约20%,缓存读取低至0.2美元。开发者实测称其3D生成与长程代码重构能力明显提升,Fable5.2同步现身内测。」
就在外界普遍盯着Opus5.2的发布档期时,Anthropic似乎选择了一条更激进的路线。最新流出的线报显示,下一代旗舰的版本号直接跳到了5.5,代号为claude-wafer-eap的Claude Opus5.5已经在悄悄内测。该消息最早由开发者Lyra扒出,按目前口径,动作快的话它可能在本周二就直接面向市场。
比版本号更扎眼的是流出的定价单。按未经官方确认的API价格,Opus5.5预计为每百万Token输入4美元、输出20美元,对比现役Opus5的5美元和25美元,降幅约20%。真正关键的变化在缓存机制:缓存读取降到每百万Token0.2美元,写入5美元。0.2美元的缓存读取单价,意味着企业搭建长时间、长上下文的自主Agent系统,开销将出现数量级的下降。这套价格策略指向一个明确方向,Anthropic正在把顶级模型从奢侈品变成日常可用的生产力工具。
内测开发者的反馈给出了更直观的能力画像。开发者Harshith上手后直言,Opus5.5比之前的Fable5.1和Astra都要强。他让5.5生成一个Waymo无人车的3D模型,还原度相当高,连捷豹车标、车顶激光雷达传感器这些细节都生成得清清楚楚。这次调用也暴露了它恐怖的产出量:输入仅1.4k,输出却达到532k,缓存跑了41.2M读取加1.7M写入,而成本只有Opus5的一半左右。开发者Veee则让它基于Three.js写了一个网页端3D汽车展示器,渲染质量和交互都相当扎实;换成更硬核的任务,它甚至能一次性吐出一个3D交互式瓦力机器人控制台,UI布局、机械绑定和IP还原度都显出很强的专业度。不少内测开发者反馈,新checkpoint的解题直觉、深层代码重构能力和长程多步骤规划,已明显拉开与现款Opus5的代差。
Opus之外,Fable这条线也有了新动静。开发者Pankaj Kumar放出了Fable5.2的尝鲜体验,表示官方似乎正把5.1悄悄切到5.2。他上手后评价很高,称Fable5.2的3D生成能力不仅追平Astra,甚至大有反超势头,而且不需要详细prompt就能准确揣摩用户意图。他试着建了一个悬崖别墅的3D场景,打光、材质反射和氛围感都挑不出毛病;更夸张的是它能用Three.js一口气生成完整小游戏,配色、排版、字体和界面布局都很在线。另一位开发者Chetaslua在测试中没有喂任何现成素材、没开MCP插件、也不需要灵感草图,Fable5.2纯靠原生JS硬写出一个微缩世界,那只Claude吉祥物完全是用纯代码一笔笔渲染出来的。网友的同款测试里,它搭出一个能跑动的小型JS系统,几十种不同的头部建模、面部微表情、动态效果、控制面板和交互逻辑,全在一次生成里严丝合缝地跑了起来。
回看时间线,Anthropic的节奏确实反常。7月24日Claude Opus5正式发布,其间短暂冒出过一个5.2的测试checkpoint,现在干脆跳到5.5。这家公司从一开始就没打算做常规迭代,而是奔着放大招去的。与此同时,OpenAI此前放出的GPT-6 Astra把科学推理和模型能力拔到了新高度,但高昂的推理开销注定它难以被日常敞开使用,于是最近在API接口里被扒出的gpt-6-sol,瞬间成了开发者最翘首以盼的角色。Google这边同样不能再等,Gemini3.5Pro因进化程度有限被内部取消,Gemini4Pro成了唯一希望,在Arena实测中以代号gemini-3.8-flash出现、各项指标表现突出,Logan Kilpatrick更直言Gemini4将是Google迄今规模最大的预训练项目。
把镜头拉远,这一轮大模型换代之所以让所有人坐不住,是因为Anthropic、OpenAI和Google步调出奇地一致,把火力集中到了同一块战场:谁能用更低的价格提供更强的综合能力。跳级、降价、提前内测,本质上都是在开发者大会等关键节点之前,先把开发者的钱包份额抢回来。从目前流出的信息看,Opus5.5与Fable5.2这套组合拳,既是对竞品的正面回应,也是Anthropic对自身产品线的一次重新定位。
来源:Heooo AI工具导航