Anthropic 将 Claude Opus 5.5 定位为复杂编程、研究和长程专业工作的旗舰模型。官方表示,它在多数工作上的表现达到 Claude Fable 5.1 水平,同时典型任务运行成本比 Opus 5 低 40%;新价格本身比上一代下降 20%,模型也更常用较少 token 完成任务。公告列出代码迁移、网站性能优化、长时间办公任务等早期使用案例。阅读 Anthropic 发布说明。

Claude Opus 5.5 发布,输入输出单价下调 20% 官方配图
图片来自 Anthropic 的官方发布页面;点击图片可查看原始来源。

价格到底降在哪里

标准 API 价格为每百万输入 token 4 美元、输出 token 20 美元,较 Opus 5 的对应单价低 20%;缓存读取为每百万 token 0.20 美元。Anthropic 另称,在其典型工作负载与默认设置下,任务总费用平均可降低 40%。两者不是同一个数字:一部分来自 token 标价下降,一部分来自完成同一工作所需 token 减少。团队应以自己的代码库、文档长度、工具调用和重试次数测算实际成本。

Fast mode 采用单独价格:每百万输入 token 8 美元、输出 token 40 美元。若任务对响应速度要求高,可测试快速模式是否节省等待时间;若是后台批处理,则需要比较额外费用是否有意义。基准测试不能直接说明你的团队会得到相同的成本节省。

如何评估它处理复杂任务的能力

  1. 收集真实、可复现的难题,例如跨模块代码迁移、性能回归定位或长文档中的证据综合。
  2. 固定模型可用的工具、上下文和验收标准,并让 Opus 5 与 5.5 完成同一任务。
  3. 记录结果正确性、测试通过率、人工审查与返工时间、标准/快速模式的 token 费用。
  4. 允许模型在临时分支或沙盒里提议和测试修改;合并、发布和高影响改动仍经过工程师审批。

安全与可用范围

Anthropic 公布了外部评估和其自动行为审计结果,并称 Opus 5.5 更能遵守边界、抵抗提示注入,但同时提醒模型仍可能犯错。由于其生物学和网络安全能力达到更高水平,相关研究用途采用额外验证计划;符合条件的组织可申请生命科学验证,网络安全验证范围也将逐步扩大。普通开发和复杂知识工作不应与受限的高风险领域权限混为一谈。使用前还应分别核对 Claude、API 与云平台的地区、模型名和限额。