Opus 5.5 的降价不是发布会上的漂亮数字,是 Claude Code 用户账单上能看见的变化。输入和输出 token 比 Opus 5 便宜 20%,缓存读取便宜 60%——前者是常规折扣,后者才是真正动刀的地方。
为什么盯着缓存?因为在编码代理这类工作流里,单价的权重远不如你想的那么大。跑一个任务往往要几十轮工具调用,每一轮都得把系统提示、文件内容、历史对话重新喂进上下文,而这些重复输入绝大部分走的是缓存。缓存单价砍掉六成,等于把整个流程的成本底座往下压了一截。反过来讲,如果某个任务高度依赖一次性的大段新输入、缓存命中率低,那 20% 的输入降价就是你能拿到的全部。同一纸调价,落到不同任务身上,效果差得很远。
原作者没有停在百分比上,而是算清楚了一个任务在 Claude Code 里跑完究竟要多花或少花多少钱,顺手把计算器放了出来。读者可以在 /usage 里跑自己的账,用真实用量替代别人的假设。这个动作本身比结论更有意思:模型定价的比价单位,正在从「每百万 token 多少美元」滑向「完成一个任务多少美元」。前者是采购部门看的指标,后者才是开发者深夜盯着屏幕时真正关心的东西。厂商开始按后者的逻辑调价,说明这场竞争已经从参数表打进了工作流内部。

