NVIDIA 和 Microsoft 在旧金山同台,宣布为 Windows PC 联手打造 AI Agent 的软硬件底座。消息不长,分量不轻:智能体的主战场,正在从云端往下搬。过去一年,大家在浏览器和聊天框里跟模型对话;接下来,Agent 要直接在你桌面上翻文件、开应用、点按钮。
为什么非得在本地跑?延迟、成本、隐私,一个都跑不掉。云端推理每一步都要往返一次网络,Agent 一旦开始多步操作,延迟会叠加成灾难;token 账单同样如此。更别提把整块硬盘的上下文传出去这件事,企业 IT 部门第一个不同意。NVIDIA 手里的牌是 RTX GPU 的算力和显存,Microsoft 手里是 Windows、Copilot Runtime 和整套开发者工具链。一个出芯片,一个出系统入口,小模型落在本地,大模型留在云端兜底,这条分工线只会越来越清楚。
真正值得盯的不是发布会上的演示,而是开发者能不能低成本地把自己的 Agent 接到系统 API 上。Windows 生态里躺着十几亿台设备,只要调用链路足够短,本地 Agent 就有机会长成新的分发入口——这也是 Apple、AMD、Qualcomm 都在抢的位置。谁的开发者先跑起来,谁的 PC 就先换代。

