马斯克又一次亲自下场给自家模型站台。他引用 Artificial Analysis 的评测数据称,Grok 4.7 让 xAI 在智能体编码这条赛道上坐上第三把交椅,前面只剩 Anthropic 和 OpenAI。同一份评测里,Grok 4.7 的智能指数拿到 46,编码智能体指数升到 56——后者比前者高出一截,意味着这款模型在写代码、调工具、跑多步任务时的表现,明显好过它答常识题或做纯推理题的水平。
第三名这个位置,说好听是跻身第一梯队,说难听是还没进决赛圈。Anthropic 靠 Claude 系列在智能体编码上攒了很长时间的口碑,OpenAI 则用 Codex 系产品把开发者的使用习惯养熟了。xAI 是后来者,拼的是迭代猛、发布勤。而真正让开发者纠结的,往往不是榜单名次,是速度与成本的权衡:同样一个任务,快一倍但贵三成,还是慢一点但便宜一半?答案取决于你是在跑 CI 流水线,还是在做交互式补全。
Artificial Analysis 的指数把延迟和每百万 token 价格都算了进去,所以 Grok 4.7 那 56 分不只是能力分,也是性价比分。马斯克转这条数据,潜台词很直白:别只盯着谁最强,也看看谁最划算。对 xAI 而言,智能体编码是必须拿下的滩头阵地,这里聚集着最愿意掏钱、也最挑剔的一批用户。第三名是入场券,不是终点。

