Anthropic 发布 Claude Opus 5.5 的当天,OpenAI 就把 GPT-6 Sol 和 GPT-6 Luna 摆上了桌。这不是回应,是截胡。更扎心的是定价:两款 GPT-6 分别只卖 GPT-5.6 同档型号的一半,Luna 的输入低到 $0.10/M、输出 $0.50/M。两年前这个单价连跑批量摘要都算奢侈,如今它已经能进主力候选名单。
Anthropic 的回击是降价。Opus 5.5 全线下调 20%,落到 $4/$20,缓存读取一口气砍掉 60%。明面上是促销,实际是承认推理成本的曲线已经压不住了——上下文越长、调用越频繁,缓存这一项就越像真正的胜负手。同一周里两家同时动价格,说明模型层正在加速商品化。对开发者而言,问题早就不是谁跑分高,而是单位任务花掉多少钱、换回多少能用的输出。
Simon Willison 的实测之所以值得看,在于他把定价和推理表现摆在一起对照,而不是单看某一项。这才是选型的正确姿势。闭眼冲旗舰的年份结束了,接活之前先拿自己工作流里最脏、最长的那条 prompt 跑一遍,比任何榜单都诚实。便宜不等于划算,贵也不等于稳;跑不通的模型,零成本也是成本。

