如果你还在用提示词模板拼 Agent,大概率已经感觉到天花板了。把 Harness 当成又一个 Agent 框架,是对它最大的误读。它真正的价值不在模型层,而在 Cordis 内核如何让 Agent 在运行时像插拔显卡一样装卸能力。这件事比任何提示词模板都更值得拆开看。
先扔掉模板思维,Agent 需要的是插槽
为什么模板化 Agent 正在失效
过去一年,多数 Agent 开发走的是模板路线:把提示词、工具调用、记忆模块打包成一个固定配方。Demo 跑得很顺,但一进生产环境就露馅。场景稍微变化,比如给客服 Agent 加一个退款查询能力,就得改提示词、重新跑回归,稍有不慎整个行为链都会抖。原因很简单:模板把执行逻辑焊死在文本里,文本越复杂,越难维护。模型再强,也救不了僵硬的编排。
Harness 的插件化不是微服务复刻
Harness 选择了一条不同的路。它把能力拆成插件,但不是微服务那种远程调用。插件运行在 Agent 进程内部,由 Cordis 内核统一管理生命周期。可以这样理解:单体 Agent 是一台焊死所有零件的整机,插件化 Agent 是一块主板加 PCIe 插槽。能力按需插入,不插就不占上下文,也不干扰主流程。这个差别决定了后期维护成本。
从“写提示词”到“装配能力”
这种架构逼着开发者换一种思考方式。以前大家花大量时间调提示词,现在更多时间花在能力边界和组合顺序上。Harness 把这种转变固化到框架层,让你没法再偷懒堆一段长 prompt 了事。尤其当 DeepSeek 这类模型把推理能力拉满后,执行层的灵活编排反而成了瓶颈。模型已经听得懂人话,缺的是能让它按需调用工具的骨架。
Cordis 的时间与空间,才是 Harness 的命门
时间可组合性:能力按阶段挂载
Agent 执行任务通常分阶段:理解意图、制定计划、调用工具、反思结果、输出答案。Cordis 的时间维组合,允许不同阶段挂载不同插件。比如规划阶段用一个轻量推理插件,反思阶段挂一个结果校验器,两者互不干扰。这种阶段隔离减少了上下文污染,调试时也能快速定位是哪个环节出了问题,而不是面对一整段混沌的生成结果。
空间可组合性:同一时刻多能力并行
空间维度解决的是并行问题。一个 Agent 在同一时刻可能既要搜索网页,又要读写长期记忆,还要执行一段代码。传统做法是把所有工具塞进一个长列表,让模型自己选,结果常常是工具描述互相打架,或者模型只挑最熟悉的那个。Cordis 给每个插件独立的命名空间和状态区,并行能力之间通过明确的数据通道交换信息,而不是在全局上下文里混作一团。
插拔发生在运行时,不是配置时
很多框架也号称支持插件,但要求启动前全部配好,运行中途想加一个能力只能重启。Harness 的 Cordis 允许 Agent 在执行过程中根据中间结果动态加载或卸载插件。比如 Agent 发现自己需要查询某个专业数据库,但当前没有对应插件,它可以请求挂载。这种灵活性建立在时间与空间组合之上——既要知道什么时候插,也要知道插在哪个位置不影响其他能力。
模型过剩,编排稀缺,开源生态在抢什么
DeepSeek 们把推理成本打下来了,然后呢
开源模型的进步速度比很多人预想得快。DeepSeek 等模型让中小团队也能跑起来复杂推理,成本还在持续下探。但模型能力越强,越暴露编排层的短板。你手里有一台强劲的引擎,却没有好的变速箱和悬挂,车照样开不稳。Harness 这类基础设施填补的正是这个位置:不是让你多一个模型选择,而是让模型的能力被稳定地转化成业务动作。
Agent 基建的开源生态需要“可解释的复杂度”
开源生态里不缺 Agent 框架,缺的是把复杂度讲清楚的框架。很多项目为了易用性做了大量黑盒封装,出了问题用户根本不知道从哪里查。Harness 把复杂度集中在 Cordis 内核里,并用时间与空间模型解释能力组合,这让它比那些开箱即用的模板更有生命力。看看周边实践就知道趋势:蚂蚁百灵与 ASystem 团队在单机 Agentic RL 后训练闭环上发力,Claude 接管应用日常维护跑了 388 个 PR,这些都说明真正有用的 Agent 不是一次性生成,而是持续运行、持续调整的系统。
给实践者的三条硬建议
第一,别再把 Agent 当聊天机器人包装,它应该是一个可装配的执行单元。第二,选框架先看能力插拔机制,再看模型支持列表。第三,把 Agent 的运行日志当成基础设施的一部分来对待。Cordis 这类内核的价值在于可观测、可调试,而不是 GitHub 上有多少颗 star。想清楚这三点,再回头看 Harness,你才不会被“又一个新框架”的表象迷惑。

