技术进展

Anthropic发布Claude Fable 5.1与Mythos 5.1

Heooo 09月02日08时03分 3 阅读

「Anthropic推出Claude Fable 5.1和Mythos 5.1模型,性能显著超越前代,在编程、科学计算和知识工作方面表现突出,同时缓存读取费用下调75%,并引入企业级安全防护与欧盟合规水印机制。」

当地时间9月1日,人工智能公司Anthropic正式发布了两款新一代大语言模型:Claude Fable 5.1 和 Claude Mythos 5.1。这两款模型基于相同的基础架构,但在安全策略上有所区分——Fable 5.1面向所有用户开放,而Mythos 5.1则仅通过可信访问计划向网络安全和生命科学领域的审核机构提供。


在性能方面,Fable 5.1展现出显著提升。根据Anthropic公布的基准测试数据,该模型在智能体科学研究基准Terminal-Bench-Science 0.1中得分高达52.6%,远超前代Fable 5(24.7%)、Opus 5(29.0%)以及OpenAI的GPT-5.6 Sol(22.4%)。在编程能力测试Terminal-Bench 4.0中,Fable 5.1得分为55.8%,而Mythos 5.1在更宽松的安全限制下更是达到了60.9%。


知识工作能力同样获得增强。Fable 5.1在GDPval-AA v2测试中取得1853分,优于Opus 5的1824分和Fable 5的1723分。与此同时,Anthropic大幅优化了使用成本:缓存读取费用下调75%,降至每百万词元0.25美元;典型工作负载下整体成本降低约25%,高度智能体化任务甚至可节省高达45%的成本。


为满足企业对数据隐私的高要求,Anthropic推出了全新的“企业级前沿防护措施”(Enterprise Frontier Safeguards,EFS),将零数据保留与高级安全机制结合,确保客户数据存储于其自主控制的云环境中。在EFS全面上线前,符合条件的企业仍可启用零数据保留政策使用Fable 5.1。


安全机制也得到改进。新版模型在网络安全场景中的误报拦截减少约60%,并允许用于漏洞发现,但禁止生成利用代码。在生物学领域,Mythos 5.1已展示出强大的分子设计能力,在多个靶点上实现比现有最佳方案高10倍的结合亲和力,命中率接近50%,远高于行业平均的10%至15%。


此外,Fable 5.1还成功应用于NASA金星雷达数据处理,生成覆盖三分之一金星表面、分辨率达2至3公里的高程地图,精度提升25%。在计算生物学方面,Mythos 5.1通过自定义GPU内核将七个开源深度学习模型加速最多2.5倍,预计可降低30%至60%的GPU成本。


合规层面,Anthropic已签署欧盟《人工智能法案》相关准则,并为Fable 5.1输出内容嵌入不可见水印,以满足2026年8月起的透明度要求。配套的检测API正以私有预览形式向监管、执法及媒体等机构开放。目前,Fable 5.1已在AWS、Google Cloud和Azure全面上线,开发者可通过Claude API调用;Mythos 5.1则暂限经审核的美国组织使用。

# Anthropic # Claude # 大模型 # AI编程 # 企业AI

来源:Heooo AI工具导航