资讯动态 · 消息 · 模型更新
Claude Sonnet 5.5 发布:速度提升,单次任务成本该怎么算?
Anthropic 9 月 28 日发布 Sonnet 5.5。梳理官方速度与成本口径、Token 单价,以及编程任务升级前应比较的指标。
RootFlowAI 内容维护团队 · 发布 · 核对
Anthropic 于 2026 年 9 月 28 日 发布 Claude Sonnet 5.5,将它定位为处理日常开发、明确范围的任务和办公文档的模型。官方表示,相比 Sonnet 5,新版本输出速度提升超过 30%,多数工作中每项任务的成本最多下降约 30%。
这条消息最值得开发者关注的,是更快完成同一项工作是否同时减少总消耗。官方公布的 Token 单价没有随这次发布下调,不能把“任务成本下降”直接理解为“API 单价打七折”。
价格与成本是两套数字
发布公告列出的标准价格为每百万输入 Token 2 美元、输出 Token 10 美元、缓存读取 Token 0.20 美元,与 Sonnet 5 相同。官方测试中的任务成本下降,来自完成同类工作时通常需要更少 Token。
对长时间运行的编程助手,一次任务可能包含多轮上下文读取、工具返回、重试和最终输出。只看最后一段回答的长度,无法判断总费用。应分别记录输入、缓存读取、缓存写入和输出,再核对所用服务商的账单口径。上述美元价格属于 Anthropic 官方公告,不代表 RootFlowAI 的销售价格。
哪些任务适合先试
官方把 Sonnet 5.5 的主要优势放在范围明确的日常任务,例如修复已定位的问题、迭代界面、制作文档、表格和幻灯片。公告同时指出,复杂、开放且需要持续判断的工作仍是 Opus 5.5 更突出的场景。
可以先挑选有明确验收条件的真实任务:一个有复现步骤的缺陷、一份需要固定格式的报告,或一个带测试的组件修改。让新旧模型使用相同代码、工具权限和成功标准,记录首次完成率、返工次数、耗时与总费用。较快的输出只有转化为较少等待和返工,才有实际收益。
基准分数应该怎样读
Sonnet 5.5 在多项官方评估中有明显提升,但不同评估使用的工具环境和推理强度并不相同。公告也提醒,基准只能呈现能力的一部分;某一项分数接近或超过更高档模型,不能推出所有工作都可以直接替换。
对团队而言,更有意义的比较单位是“完成一次可验收任务需要多少钱”。如果提高推理强度后费用上涨,应一并衡量它是否减少失败、回退和人工检查。
接入前核对什么
先确认账户和所选服务商实际开放的模型标识、工具调用能力、上下文限制及计费方式,再小范围迁移。本文整理官方发布信息,未进行本站线路的 Sonnet 5.5 性能测试,也不据此声明本站已开放该模型。