今年(2026),“AI 自我改进”这件事,开始变得认真了。
3 月,Karpathy 开源了 autoresearch,Agent 能自己改代码、跑实验、根据结果决定留不留,跑通了一个最小而真实的改进循环。随后 Anthropic 正式讨论了递归自我改进,Rod Johnson 也断言——今天这波框架,可能是“最后一波由人类选择的框架”。
就在这个节骨眼上,DeepSeek 开源了自己的 Agent Harness(dsh)。坦白说,一开始我也觉得“又一个 Agent 框架”,但看下去发现,它为“自进化”补上了两块最缺的工程拼图。

第一块是全插件化——连 Agent Loop 本身都是插件,没有特权内核,系统有能力改变自己。第二块是 Append-Only 会话日志——每一步思考、调用、决策都被完整追加记录,可回放、可追溯,系统有能力审视自己。
一个能改,一个能看,自进化才有了最基本的原料。dsh 本身还没实现完整的自动进化,但它的设计已经在为这件事铺路。

这也是我最近在看极客时间新上的专栏《DeepSeek Harness 前沿工程实践》的原因。吸引我的不是“教你用 dsh”——这件事用官方文档就够了。而是它从 Cordis 内核机制一路拆到多 Agent 编排,最后亲手搭一个规则自进化系统,把前面学的东西串成一个能自主进化的闭环。

学习一下 dsh 的四种用法
理解了 dsh 是什么、新在哪儿,接下来的问题就是:它该怎么用?dsh 并不是只有一种用法。我把常见的几种方式都讲给你,你可以对号入座。
第一种:把它当 Agent 工具用。
你直接跑 dsh,用官方预设(preset)组合出一套能用的 Agent,接上自己的模型,让它帮你干活。这是成本最低的用法,适合我就想先有个能跑的 Agent。
第二种:把它当插件平台用。
你可以安装自己感兴趣的插件,或者在它的扩展点上写自己的插件,比如加一个工具、接一个模型,装进自己的插件配置(cordis.yml)/ bundle。这是大多数开发者最常用的层次。
第三种:把它当二次开发平台用。
你可以深度融合自己的业务逻辑到 dsh 中,这一种较为复杂,需要对自己的业务逻辑,需求,dsh 的能力有全面深入的理解。这对开发者有一定的技术要求。
第四种:把它当自进化基础框架用。
这是 dsh 最有难度,也是最有野心的用法,你利用它的时空组合特性和 Append-Only 日志等能力,去构建能自我改进、能持续进化的系统。我们这门课的实战篇,就会带你探索这第四种用法。

当然,如果你想研究 Agent 的循环、会话、编排机制,dsh 提供了干净、可读、可替换的实现,它的源码本身就是一份很好的“Agent 架构教科书”。
你会注意到,这四种用法的门槛是递进的:从“用现成的 —> 增改局部 —> 全局利用 —> 造会进化的”。 而这,恰好就是这门课的设计逻辑。
这门专栏会怎么带你学?
课程设计了四个篇章 21 讲,由下往上、由基础到实战,门槛逐层递进:
-
基础篇:Cordis 运行机制。从可撤销的 Effect、响应式依赖,到五种事件分发模式,再到声明式配置与 HMR。这是看懂一切的地基。
-
核心篇:能力、工具与会话。能力接缝怎么接入、工具流水线怎么执行、沙箱怎么保证安全、会话日志怎么做到可追溯可续接。这是 Agent 能可靠干活的根本。
-
编排篇:从 Agent 循环到多 Agent 协作。从单个 Agent 的循环,到 Goal 驱动长任务、Subagent 委派,再到 Workflow 与 Ralph 的协调机制。这是把单点能力编排成复杂工作流的指挥系统。
-
实战篇:构建规则自进化系统。亲手搭一个防火墙 Agent,基于 dsh 扩展点搭建规则引擎,让规则可生成、可修改、可持久化;检测到异常请求时自动长出候选规则,经评测与确认后更新规则,形成持续演化的闭环。

你会发现,实战篇用到的每一样东西,都能在前三章里找到它的出处。这门课的价值,不只在学到了什么,更在于最后能把它们串成一个能自主进化的整体。
学完你会收获什么
你最终获得的不是一份 dsh 使用说明,而是三层 Agent 工程能力:
-
内核机制理解:系统理解 Cordis 的时空组合、依赖注入与插件生命周期,建立分析 dsh 架构和设计取舍的底层模型。
-
核心链路透视:贯通工具流水线、进程沙箱、Append-Only 会话日志与 Agent Loop,深入 Goal、Subagent、Workflow 和 Ralph 的实现机制。
-
自进化系统交付:亲手构建规则自进化系统,跑通异常发现、候选规则生成、评测确认与持久化,让“自进化”成为可以解释、实现和复用的工程能力。
如果你只想启动 dsh、调用几个工具,官方文档已经足够。这门课真正要解决的,是更深一层的问题。

写在最后
Agent 的故事其实才刚刚进入下一阶段,模型能力解决的是“它能不能做”,而工程解决的是:它能不能稳定地做、能不能在犯错之后恢复、能不能被验证、被治理、并真正进入生产环境。
当 AI 从“工具”开始变成“执行者”,甚至开始参与自身的进化,工程师真正需要掌握的,也许不再只是如何使用 AI,而是如何给 AI 建立一套能自我审视、自我改进、值得被托付的工作环境。
这可能就是“自进化”真正值得我们花时间理解的工程命题。
191

被折叠的 条评论
为什么被折叠?



