人工智能

Anthropic 发布 Claude Opus 5.5:成本较 Opus 5 降 40%,强化编码与安全能力

2026年9月23日 · admin
OpenMagic API

据 IT之家 9 月 23 日消息,Anthropic 今日正式发布 Claude Opus 5.5,这是全新 Claude 5.5 家族率先登场的模型。来源显示,Anthropic 将其定位为面向复杂知识工作、智能编码和计算机使用场景的高性能模型,并宣称其在多数任务上的表现可媲美 Claude Fable 5.1,同时在默认设置下,典型工作负载运行成本比 Opus 5 低 40%。对于正在评估大模型 API、企业智能体和代码自动化工具的团队来说,Opus 5.5 的重点不只是“更强”,还包括更低成本、更快输出和更严格的安全边界。

编码、软件优化与复杂任务能力提升

从 Anthropic 公告披露的信息看,Claude Opus 5.5 相比 Opus 5 在复杂工作中的表现有明显提升。官方称,早期测试者在最复杂的任务中观察到性能大幅改善。其中一个案例是,测试人员在不到一天内完成了 68 万行代码迁移,而这一工作原本预计需要数周时间。

在软件性能优化方面,Opus 5.5 也被强调为更擅长发现和修复低效程序。Anthropic 要求模型缩短一个网页应用每个页面的加载时间时,Opus 5.5 在 40 次尝试中成功 39 次;相比之下,Opus 5 只做出较小改进,并且还改变了应用行为。这类结果说明,新模型不仅追求生成代码,更强调在既有软件约束下完成优化,减少“修了性能、破坏功能”的风险。

来源还提到,一位测试者让多个 Claude 模型依据单一提示构建游戏,Opus 5.5 凭借画面表现和完成精致度获得高于其他模型的评分。对开发者而言,这意味着它可能更适合承担从需求理解、代码生成到界面细节打磨的一体化任务。

  • 性能定位:面向复杂知识工作、智能编码和计算机使用场景。
  • 成本变化:默认设置下典型工作负载成本较 Opus 5 低 40%。
  • 速度变化:输出速度较 Opus 5 快 30% 以上。
  • 模型家族:Claude Sonnet 5.5 与 Claude Haiku 5.5 将在未来几周推出。

价格下调与订阅限制放宽,降低企业试用门槛

成本是本次发布中最直接的看点。Anthropic 表示,Opus 5.5 所需计算量低于 Opus 5,定价也随之调整。其输入 Token 价格为每百万 Token 4 美元,输出 Token 价格为每百万 Token 20 美元,较 Opus 5 低 20%;缓存命中价格为每百万 Token 0.20 美元,较 Opus 5 低 60%。在默认设置下,官方测试显示典型工作负载成本比 Opus 5 低 40%。

除 API 价格外,Anthropic 还放宽了 Pro、Max、Team 等企业套餐的使用时间限制,并为订阅用户提供速率限制重置功能,客户可以随时保存和使用。对于需要把 Claude 接入内部知识库、自动化工作流或研发工具链的组织来说,这类调整可能比单纯降低单价更有实际意义,因为企业部署通常受限于调用峰值、长任务持续时间和多人协作配额。

安全与对齐:面向生物、网络安全等高风险场景加防护

安全方面,Anthropic 称 Opus 5.5 在其自动化行为审计中取得了迄今为止所有模型中的最高分。该审计套件会在数千个模拟场景中测试 Claude 的行为边界。来源显示,Opus 5.5 相比近期其他模型,更不容易采取难以逆转的行动或超出既定边界,并且比 Opus 5 更能抵抗提示注入。

Anthropic 还扩大了对齐测试范围,覆盖更长任务、不可能完成的任务,以及基于真实事件的场景。由于 Opus 5.5 在生物学和网络安全领域的能力与 Claude Mythos 5.1 相当,官方部署时采取了类似 Claude Fable 5.1 的防护措施。经过审核的机构目前可申请生命科学验证项目,用于生物学研究;未来几周,Anthropic 还将扩大网络验证项目访问,认证网络安全从业者可使用 Opus 5.5 开展相关工作。

解读:高性能模型竞争进入“效率与可控性”阶段

从本次发布看,Anthropic 并未只强调基准测试分数,而是把成本、速度、安全和沟通体验放在同等重要的位置。官方称 Opus 5.5 的表达更自然,文字更清晰,会把重要信息放在前面,并在长时间协作中更像工作伙伴。这与当前企业用户的需求一致:模型不仅要能完成难题,还要能稳定嵌入日常流程。

对中文开发者和企业用户而言,Claude Opus 5.5 的信号在于:前沿模型正在从“能力展示”转向 可规模化使用。更低的 Token 成本、更快输出、更强提示注入抵抗能力,都会影响智能编程、自动化运维、知识管理和科研辅助等应用的落地速度。随着 Sonnet 5.5 和 Haiku 5.5 未来几周推出,Claude 5.5 家族可能进一步覆盖从高端复杂任务到轻量高频调用的不同层级,推动大模型工具链进入新一轮性能与成本竞争。