
Anthropic这次没有只发布一个更强模型,而是同时调整了“长期任务怎么计费”和“高风险能力交给谁”。9月1日,Claude Fable 5.1向通用企业用户开放,Claude Mythos 5.1继续面向经过审核的网络防御与生命科学组织。两者使用同一底层模型,却通过安全策略和访问门槛形成两个能力面。对大量复用上下文的Agent应用,最直接的变化是缓存读取价格降低75%。
Fable 5.1的基础价格没有变化,每百万输入token 10美元、输出token 50美元;缓存读取则从Fable 5的水平降到0.25美元。Anthropic估算,典型工作负载总成本可降低约25%,高度Agent化任务最高约45%。这里的关键条件是缓存命中:项目说明、代码库摘要、业务规则和工具定义被反复调用得越多,节省越明显;一次性问答几乎不会获得同等收益。
这与Fable 5.1的定位相互配合。Anthropic强调它可以持续数小时处理跨应用、无人值守的托管任务,也覆盖代码、企业文档和视觉材料。长任务最大的成本往往不是新输入,而是每一步都要重新读取稳定背景。缓存更便宜以后,团队可以把更多预算留给实际推理和工具执行。不过,缓存命中率、失效策略和上下文膨胀必须被监控,厂商给出的25%与45%不是所有部署都能复现的固定折扣。
Fable 5.1允许识别源代码中的漏洞,这比早期通用版本更接近真实开发流程;但渗透测试、漏洞利用生成和二进制扫描仍受限制。生物安全方面,Anthropic称误拦截比Fable 5初版减少85%,双重用途的生化请求仍会转交更严格的模型处理。对企业使用者,这种变化比“拒绝更少”更具体:正常代码审查和研究材料可以更顺畅,高风险动作仍需要不同权限路径。
Fable 5.1已向Pro、Max、Team与Enterprise用户提供,也可以通过Claude Platform、AWS、Google Cloud和Microsoft Foundry调用,模型标识为claude-fable-5-1。多入口意味着迁移并不只是改一个模型名。团队还需核对各平台的数据保留、区域、缓存实现、工具权限和速率限制,尤其要确认同一提示缓存是否跨项目隔离,以及删除和失效动作能否被审计。
Mythos 5.1目前首先面向美国境内、经过审核的网络防御和生命科学组织,起步价格同样为每百万输入与输出token 10美元和50美元。它不是简单的“更贵高级版”,核心差异是申请者身份、任务目的和使用环境。相同底层模型在不同产品里承担不同风险,这让账号审核、用途证明、监控和撤销权限成为模型交付的一部分。
这种双轨设计也会增加治理复杂度。企业若同时使用Fable与Mythos,需要防止高风险结果被复制到低权限工作区,并为跨版本升级建立评测集。模型名称相近不代表行为完全一致;安全策略改变可能影响工具调用、拒答率和自动化任务完成率。上线前应在自己的代码、文档和审批流程上做回归测试,而不是只看通用排行榜。
Claude 5.1最值得企业关注的,是两个常被分开讨论的问题被放到同一版本里:长期Agent需要更便宜地复用背景,高风险能力则需要更严格地证明用途。缓存降价会推动更多任务从短对话变成长流程,但运行时间越长,权限累积、错误传播和失效上下文的代价也越高。成本优化不能脱离可观测性。
实际落地可先选一个上下文稳定、结果可人工验收的流程,记录缓存命中率、总token、工具失败和人工介入,再比较升级前后的完整成本。涉及网络或生命科学能力时,应把版本资格、数据边界和结果流转写进权限模型。75%的单价降幅很醒目,但能否转化为可控的生产效率,取决于缓存里放什么、多久失效,以及谁能调用缓存背后的能力。
