Anthropic 推出 Claude Fable 5.1 与 Mythos 5.1:强化编程科研能力,缓存读取价格降至原四分之一
据 IT之家消息,Anthropic 于当地时间 9 月 1 日发布 Claude Fable 5.1 和 Claude Mythos 5.1 两款新模型,并将其定位为面向编程与知识工作的前沿模型。来源显示,两者采用相同基础模型,但在安全防护策略和开放范围上有所不同:Fable 5.1 面向所有用户开放,而 Mythos 5.1 仅通过可信访问计划提供给经过审核的网络安全、生命科学等领域机构。
这次更新的核心并不只是“更强模型”,还包括成本、企业数据保留、安全误报控制以及 AI 生成内容水印等一系列配套变化。对于开发者、企业用户和科研机构来说,Claude 5.1 系列更像是 Anthropic 在“智能体工作流”和“高风险科研场景”之间做出的分层产品设计。
编程、知识工作与科研基准均有提升
性能方面,Anthropic 公布的基准测试显示,Fable 5.1 在多项任务上超过前代 Fable 5、Opus 5,以及来源中提到的 OpenAI GPT-5.6 Sol。在智能体科学研究基准 Terminal-Bench-Science 0.1 中,Fable 5.1 得分为 52.6%,高于 Fable 5 的 24.7%、Opus 5 的 29.0% 和 GPT-5.6 Sol 的 22.4%。
在智能体编程基准 Terminal-Bench 4.0 中,Fable 5.1 得分为 55.8%;采用更宽松安全防护的 Mythos 5.1 达到 60.9%。知识工作方面,Fable 5.1 在 GDPval-AA v2 测试中取得 1853 分,高于 Opus 5 的 1824 分和 Fable 5 的 1723 分。
从这些指标看,Anthropic 强调的不再只是单轮问答能力,而是模型在终端环境、工具调用、长链路任务执行和科研问题拆解中的表现。这与当前 AI 产品从“聊天助手”向“智能体系统”迁移的趋势一致。
价格策略:缓存读取费用下调 75%
此次发布中,成本调整同样值得关注。Anthropic 表示,Fable 5.1 的缓存读取费用下调 75%,降至每百万词元 0.25 美元。基础定价保持不变:输入词元每百万 10 美元,输出词元每百万 50 美元。
按照 Anthropic 的说法,在典型工作负载下,Fable 5.1 的成本比 Fable 5 低约 25%;对于高度智能体化的工作负载,成本最高可降低 45%。这意味着对于频繁复用上下文、反复调用工具、执行多步骤任务的应用,缓存机制会成为降低推理成本的重要手段。
- 模型开放:Fable 5.1 面向普通用户;Mythos 5.1 通过可信访问计划提供。
- 能力方向:重点覆盖编程、知识工作、科学研究与智能体任务。
- 成本变化:缓存读取价格降至每百万词元 0.25 美元。
- 企业隐私:Anthropic 推出 EFS,强调零数据保留与企业控制云基础设施。
企业数据与安全防护:在开放能力和风险控制之间分层
企业侧,Anthropic 推出 Enterprise Frontier Safeguards(EFS)方案,称其将零数据保留隐私保护与先进安全防护结合。根据来源信息,客户数据将存储在由企业完全控制的云基础设施中,而不是 Anthropic 系统中。EFS 计划于今年秋季分阶段面向企业客户推出;在 EFS 可用前,符合条件客户可在零数据保留政策下使用 Fable 5.1。
安全方面,Anthropic 称其改进了 Fable 5.1 的防护机制,以减少误报。在网络安全领域,新版防护措施的误报拦截数量比此前减少约 60%。Fable 5.1 可用于发现软件漏洞,但不会用于开发针对这些漏洞的利用程序。这一边界设置也反映出模型厂商在网络安全场景中的典型取舍:支持防御和审计,限制武器化利用。
科学能力展示:从蛋白质设计到金星高程地图
来源显示,Anthropic 展示了 Mythos 5.1 和 Fable 5.1 在科学计算中的多个案例。在分子设计领域,Mythos 5.1 利用开源蛋白质设计和折叠工具设计高亲和力结合剂。在三个靶点上,其结合亲和力比 Adaptyv Bio 蛋白质设计竞赛最佳参赛作品高出 10 倍;在 12 个靶点上的命中率接近 50%,高于目前蛋白质设计典型 10% 至 15% 的命中率。
在计算分析领域,Fable 5.1 基于 NASA 麦哲伦任务 30 多年前的雷达图像,训练神经网络并绘制覆盖金星三分之一区域的高分辨率高程地图,将分辨率从此前 10 至 20 公里提升至 2 至 3 公里,高程精度提升 25%。在计算生物学领域,Mythos 5.1 通过编写自定义 GPU 内核并缓存中间结果,将七个开源深度学习模型速度最高提升至 2.5 倍,预计 GPU 成本可降低 30% 至 60%。
解读:Claude 5.1 系列显示大模型竞争进入“场景分级”阶段
对中文科技行业观察者而言,Claude Fable 5.1 与 Mythos 5.1 的发布重点不只是分数提升,而是产品边界更清晰:通用能力交给 Fable,敏感且高价值的科研能力交给受控访问的 Mythos。同一基础模型、不同安全等级,可能会成为前沿模型商业化的一种常见形态。
此外,缓存读取费用大幅下降,也表明大模型厂商正在围绕智能体工作流优化成本结构。随着代码生成、数据分析、科研检索和自动化执行越来越依赖长上下文与反复调用,推理价格不再只看输入输出单价,缓存、工具调用、数据治理和合规能力都会影响企业最终选择。
合规方面,Anthropic 已为 Fable 5.1 生成文本加入不可见水印,并以私人预览形式推出检测 API,面向符合条件的监管机构、执法部门、媒体和事实核查机构等开放。来源称,该水印不包含用户或对话信息,也不影响输出质量。对于生成式 AI 内容治理来说,这意味着模型厂商正把透明度要求前置到模型发布流程中。