Claude Sonnet 5.5 发布:单价未变,为什么仍可能降低任务成本?
2026年9月28日,Anthropic发布Claude Sonnet 5.5,定位包括范围清晰的日常工作、修复错误和制作办公文件。官方称其输出速度比Sonnet 5快30%以上,并在自身测试中实现每项任务最高约30%的成本下降。这些属于厂商测试结果,不能当成每个项目都会兑现的承诺。官方发布说明。
图:AI生成概念配图,表现任务执行路径,非产品界面或实测数据。
先分清两种“更便宜”
官方列出的基础API价格与Sonnet 5相同:每百万输入token为2美元,输出为10美元,缓存读取为0.20美元。其所称的任务成本下降,主要来自完成相同工作时使用更少的token,而不是全面下调这些单价。若一个工作流仍然反复重试或持续产生长输出,账单未必同步下降。
实际影响:预算应围绕完整工作单计算
以下为本站分析。比如一次代码修改,不能只统计第一次响应。合理的边界是从读取需求开始,到修改通过测试、人工接受为止,把失败尝试、补充说明和工具调用后的继续推理都算入同一工作单。若旧模型一次写对、新模型三次才通过,即便单轮更快,也未必更省。
可先选一个稳定的小模块作为试点:固定仓库版本、任务描述和验收命令;保存模型设置;记录总输入输出量、用时、是否通过以及人工修改。结果至少按任务类型拆分,避免把文案润色的节省比例套到复杂故障分析上。涉及缓存的工作,还要确认输入前缀能否真正复用。
不要把任务效率误读为所有能力同档
官方仍把更复杂、开放式、需要持续判断的工作作为Opus 5.5的优势范围。实际使用中,更稳妥的设计是给日常任务明确边界,遇到需求冲突、测试无法解释或工具行为异常时交给人判断,而不是要求较快模型无限重试。
迁移的价值可以很具体:同样质量下少等待、少返工、少耗费。先证明这一点,再扩大范围,比只追逐最新型号更有用。
信息核对:2026年10月1日(北京时间)。新闻事实来自所链接官方公告;建议与影响分析为本站独立解读。产品可用性以实际账号为准。


