多模型时代,最烦人的往往不是模型本身,而是给每个模型维护一套入口。Google Cloud 直接把这件事做进了 API 网关。最近推出的 Google Cloud API Gateway 模型路由功能(公开预览)允许开发者在 OpenAPI 3.x 规范里定义虚拟模型名到后端目标的映射,不再需要硬编码一长串端点,也不用自己摆弄开源代理。网关扮演无服务器入口层,接收标准的 OpenAI 兼容请求,自动把负载转码成目标模型的原生格式,然后动态路由流量——一套规范,一个入口,所有模型。
这对频繁切换大语言模型的团队是个实在利好。你可以在 OpenAPI 文件里把像“gpt-4o-mini”这样的虚拟名映射到背后的 Gemini、Claude 或任何自定义模型服务,客户端只感知一个统一 API。以前这种抽象要靠 Kong、APISIX 这类网关外挂一堆插件,或者自己写一个分派层,现在路由逻辑变成了规范本身的一部分,部署、版本管理和安全策略全跟着同一个网关走。而且 Google Cloud API Gateway 本身免运维,自动扩缩,把工程复杂度又削掉一层。
将模型路由规则基础设施化,这步棋走得安静但精准。它不是又一个模型产品,而是让多模型真正“可运营”的关键胶水。公开预览意味着还有改进空间,但方向已经足够清晰:别在入口上重复造轮子,把精力留给你真正想构建的东西。

