Anthropic于当地时间9月1日正式发布Claude Fable 5.1与Claude Mythos 5.1 。官方表示,两款模型共享同一底层核心能力 ,区别在于安全护栏的松紧程度不同。Fable 5.1即日起面向所有用户全面开放,适用于编码、知识工作和长周期代理任务;Mythos 5.1则仅通过“受信访问计划”向经过审核的组织提供,其护栏专门针对网络安全与生命科学研究等高敏感场景设计。


公司称 ,此次版本迭代直接回应了客户关于定价 、数据留存以及拦截过严等三方面的集中反馈 。Fable 5.1的API标价与Fable 5保持一致:每百万输入token为10美元,每百万输出token为50美元。缓存读取费用 大幅下调75%,降至每百万token 0.25美元。按token计费的典型工作负载估算 ,整体使用成本可降低约25%,高度代理化任务场景下比较高 可节省约45% 。美国境内用户可选取 1.1倍费用 启用推理增强功能。API标识符为claude-fable-5-1。Fable 5.1现已通过Pro、Max、Team 、Enterprise订阅计划,以及AWS、Google Cloud和Microsoft Foundry等云平台提供调用 。

性能基准实测:代理编码与知识工作显著跃升

Anthropic同步披露了多项内部及第三方评测数据(均为无工具或官方标注口径)。在Terminal-Bench-Science 0.1科学任务基准上 ,Fable 5.1得分52.6%,远超前代Fable 5的24.7%及GPT-5.6 Sol的22.4%。代理编码基准Terminal-Bench 4.0中,Fable 5.1取得55.8%,优于Fable 5的42.0%和GPT-5.6 Sol的37.3%;Mythos 5.1在该项测试中进一步达到60.9%。知识工作能力方面 ,GDPval-AA v2评估中Fable 5.1得分为1853,较Fable 5的1723有明显提升 。
在操作系统交互基准OSWorld 2.0中,Fable 5.1部分成功率为77.9% ,严格成功率为41.7%。Humanity‘s Last Exam无工具模式下得分60.9%,有工具模式提升至65.0%。AutomationBench自动化任务得分为31.4%,CursorBench 3.2.0为73.4% 。第三方评测机构Artificial Analysis给出的智力指数为66 ,代理指数为61。Anthropic指出,在低或中等推理努力档位下,Fable 5.1即可用更少计算资源追平甚至超越Fable 5的完整表现。以上数据来自厂商及评测机构 ,尚未经独立第三方审计验证 。
护栏精度大幅优化,Mythos仍限于受信场景
此次更新中,Anthropic重点对安全护栏进行了精细化调校。网络安全相关护栏的误拦截率较上一版本减少约60%。Fable 5.1现允许在源代码中查找漏洞 ,但渗透测试、利用代码编写及基于二进制的扫描等高风险操作仍会被拦截并转由Opus处理 。生物学护栏对基础生物学与医学良性问题的误触发率相比Fable 5首发时降低约85%,而双用途生物与化学相关问题仍自动转交Opus。
Mythos 5.1被官方描述为公司迄今具备最强网络安全能力的版本,仅对通过严格核验的组织开放,默认启用30天安全监测数据留存。企业前沿护栏(EFS)功能将数据完全保留在客户自控云环境中 ,官方称其效果等同于“零留存 ”,计划于今年秋季起分阶段向企业客户推出 。在上线之前,符合条件的客户可通过零留存方式调用Fable 5.1。Fable 5.1已被标注为Covered Model ,额外适用留存政策 、安全审查及访问权限管控。
发布背景:从短暂下架到新一轮云基础设施协议
今年6月,Fable 5与Mythos 5曾因美国政府的出口管制要求而短暂下架,直至7月1日恢复服务。此次5.1版本是时隔约三个月后的首次重大迭代 。值得关注的是 ,发布前夕Anthropic刚刚与云基础设施提供商Lambda签署了价值约350亿美元的合作协议,进一步扩展其算力底座。上述事件均为并行发生的商业与政策动态,并非模型本身性能的证明 ,但共同构成了Fable 5.1和Mythos 5.1问世的宏观背景。
整体来看,此次发布既是一次产品能力的跃升,也是Anthropic在安全与可及性之间寻求更精准平衡的策略体现——通过差异化的护栏配置和更灵活的费用 体系 ,将高端模型同时推向大众开发者与高敏研究机构,有望进一步拓宽Claude在代理AI和企业级应用中的落地场景 。








