企业 AI 的钱,大半没花在最强的模型上。Tomer Tunguz 在最新分析里抛出一个有点反直觉的判断:真正撑起用量的是中段市场——那些需要模型足够聪明、但价格必须算得过来的多步骤工作流。这个区间既不是玩具级的轻量任务,也不是只有实验室才烧得起的前沿推理。
证据藏在网关账单里。Anthropic 的前沿模型 Fable 5.1 上线头十二天,只占网关支出的 3.7%。同一批数据中,大型企业账户的前沿模型 token 消耗占比从 8 月初的 53% 一路压到 9 月的 45%。八个百分点听着不多,可放到每天上亿次调用的采购量级上,那就是真金白银在搬家。
别急着把这读成“前沿模型不行了”。它更像市场在做减法:任务本身用不到那么高的智能上限,多出来的能力换不成产出,却照样按 token 付费。Cursor 的选择很说明问题——用微调后的 Kimi K2.5 把成本砍掉 86%,效果够用就行。降价战打得这么凶,恰恰因为所有人都在抢同一个位置:性价比能打的中段。谁把这个区间的单位智能成本压到最低,谁就拿到企业预算的大头;至于前沿模型,更可能退回研发、评估和最难的少数场景。这条曲线的形状,比任何一次发布的基准分都更能说明接下来一年钱往哪儿走。

