Anthropic 将 Claude Sonnet 5.5 定位为适合高频日常工作的中高能力模型:修复代码问题、完成边界清楚的开发任务,以及撰写或打磨文档、演示稿和表格。官方称它比 Sonnet 5 输出速度快 30% 以上,并且在典型任务中最多可降低 30% 的单任务成本。这里的成本下降主要来自完成任务所需 token 变少,不是每个 token 的标价下降。阅读 Anthropic 发布说明。

Claude Sonnet 5.5 发布:单价不变,官方称任务成本降低 官方配图
图片来自 Anthropic 的官方发布页面;点击图片可查看原始来源。

价格与性能要分开看

Sonnet 5.5 的标准价格与 Sonnet 5 相同:每百万输入 token 2 美元、输出 token 10 美元、缓存读取 token 0.20 美元。Anthropic 表示,新版通常能用更少 token 完成同一任务,因而实际任务成本可能下降;这不保证你的工作流也正好省 30%。工具调用次数、输出长度、失败重试和人工返工都影响总账单。

Anthropic 公布了 Terminal-Bench 4.0、GDPval-AA 等评测结果,并称新版在长程工作、图像理解和协作写作方面有所改善。它特别适合较快地反复修改草稿或修复小问题;对于要求极强判断力的复杂工作,官方仍把 Opus 5.5 作为更高阶选择。基准分数来自特定测试,不能代替你团队的验收标准。

如何上手并做一次公平比较

  1. 在 Claude 产品或支持的 API 平台中确认账户能选到 Sonnet 5.5;模型标识以官方开发者文档为准。
  2. 挑 10–20 个日常任务,固定输入材料、工具权限和输出格式,分别用 Sonnet 5 与 5.5 完成。
  3. 统计一次通过率、修订次数、响应时间和 token 账单。写代码时再加上测试通过情况;写文档时检查事实与格式。
  4. 用包含真实文件和数据的内部测试集复查,不要把单个演示或榜单排名当作上线依据。

上线和安全信息

Anthropic 表示 Sonnet 5.5 已在 Claude Platform 提供,并可从 AWS、Google Cloud 和 Microsoft Azure 等平台使用。因为该模型的网络安全能力被 Anthropic 视为达到更高水平,它首次随 Sonnet 系列启用了类似旗舰模型的网络安全防护与回退机制;官方称常规软件开发不受影响。不同平台的可用地区、调用名称、限额与价格需分别核对。