关于 Agent 自进化的讨论

擎伞驻阡陌 2026-06-01 16:03 1

各位佬友好,最近对 Agent harness、skill 自进化以及多 Agent 编排这些方向有一些想法,想拿出来讨论一下,也欢迎大家指正。


目前比较热门的 harness,比如 Claude Code、Codex 这类偏编码型的 Agent,或者 Harmes、OpenClaw 这类更偏通用框架的项目,本质上看起来都比较像工具箱:先提供一套基础能力和执行环境,再通过插件市场、skill 或功能模块的方式,不断扩展 Agent 的能力边界。


这种模式在形式上有点像软件工程时代的模块化拼装:通过已有框架加外部模块来实现更多功能。但在当前 AI 能力逐渐增强的情况下,一个比较自然的方向似乎是让 AI 自己生成、修改和优化这些模块,也就是现在常见的 skill 自进化。


不过我有一个疑问:为什么目前很多自进化流程主要集中在 skill 上?skill 本质上更像是对某类任务流程的总结,用来指导模型按一定步骤完成任务。但从完成任务本身来看,除了需求侧的 skill,执行环境也同样重要。现有 harness 提供的是一个相对通用的环境,而 skill 则是对特定需求的适配。如果从这个角度看,自进化的对象似乎不应该只包括 skill,也应该包括 Agent 本身的能力结构、工具调用方式、任务拆解方式,甚至多 Agent 的组织和编排方式。


比如从 Claude Code 的 Ultracode 模式,以及 Grok 中多智能体讨论和分发处理的模式来看,感觉多 Agent 协同、分工、调度可能会是后续复杂任务处理的一个重要方向。但我目前看到的很多自进化项目,似乎还更多是在做 skill 层面的进化,较少看到把多 Agent 组织编排、Agent 运行环境或 Agent 自身结构演化作为核心方向的项目。当然也可能是我了解得还不够全面。


所以想问问佬友们,目前有没有看到类似方向的项目、文章或实践?也就是不只是让 Agent 写 skill、优化 skill,而是进一步研究多 Agent 如何组织、如何调度、如何根据任务动态调整自身结构,以及 Agent/harness 本身如何参与自进化。


我个人感觉,如果未来复杂任务越来越依赖多 Agent 分发处理,那么自进化的重点可能不只是“生成更好的 skill”,而是“形成更好的 Agent 组织方式”。但这个组织编排框架到底应该长什么样,是插件化、层级化、市场化,还是任务驱动下动态生成和重组,目前还没有想清楚。想听听大家有没有相关资料、项目或者不同看法。

最新回复 (19)
  • 晚也不安 06-01 16:18
    1

    有同样的感觉,未来多agent,搞team会是更重要的方向,可能会开很多agent

  • VonEquinox 06-01 16:23
    2

    同样的感觉,这种结构的修改的很少,有一篇可能有点关系的[2603.18000] AgentFactory: A Self-Evolving Framework Through Executable Subagent Accumulation and Reuse

  • 擎伞驻阡陌 楼主 06-01 16:29
    3

    【保存的子智能体是纯Python代码,并带有标准化的文档】他这里其实还是对skill进行优化,把过程积累成代码,还是一个封装skill的概念。我估计这篇太早了,没分清agent进化和skill进化

  • 翱翔的鹰 06-01 16:32
    4

    因为skill的进化相对简单,但现在也有一些开始做workflow相关的进化了

  • tienchiu 06-01 16:33
    5

    因为从skill的形态来看,它天生具备"自进化"的可能性。


    且,它本身就是为了"自迭代"准备的。


    你看skill的结构。


    md用来描述"干什么";

    script用来描述"怎么干";

    再加个"干的怎么样",


    那就完全具备pdca属性了。

    就可以把md、script再继续fix,实现"自进化"了

  • Yostia 06-01 16:37
    6

    我现在搓harness也能明显感觉,如果想让工作流工程化,还是需要把“将规则文本化为skill或其他什么,然后作为上下文注入”发展成”尽可能地用脚本,机械化的检验工具来替代规则的文本叙述“。本身上下文就是稀缺资源,且规则或业务背景的权重管理和维护也是非常非常头大的一件事情,所以我觉得以后ClaudeCode也好,Codex也罢,乃至未来新的Cli,都会将各种Harness策略封装进来,将现在所谓的agent自学习的闭环控制标准化

  • Skye 06-01 16:43
    7

    分享一个平台方案


    主Agent负责调度

    默认只有1个子Agent, 负责“招聘” - 创建其他临时子Agent


    整个平台最外层有一个观察者Agent, 它会在每个会话线程工作结束后总结工作, 来更新或者创建SOP, 如果有有价值的临时子Agent则会在Docker中创建沙箱撰写Nodejs代码将其固化为A2A协议的可执行程序下载到平台的Agent库中以供后续调用



    Agent自身要用的Tools和Skills都是自己摸索学习



    这个我的AI4S平台的架构, 完美的自学习循环, 就是太烧Token了

  • zhaoyu 06-01 16:46
    8

    我感觉未来会逐渐走向一种 Agent OS:harness 像内核,skill/工具像驱动和应用,多 Agent 编排则像调度系统。

  • hwang 06-01 16:48
    9

    我觉得主要还是可控、简单、解耦。



    • 可控:目前的模型还没到改了代码就一定没问题的能力,要是某次迭代改炸了,不说进化效果如何,智能体直接报废

    • 简单:自进化的skill 大多还是改md 本身,或者是不断地在原来设计到框架内填充数据/demo/例子/记忆。并没有超出一开始的设计范围,在自进化的概念刚开始大范围普及的现在,简单一些意味着容易实现

    • 解耦:这个是软件工程方面的思想了,权责范围越小,越不容易出问题、越稳定。很多时候是为了解决某个问题,而不是需要一个大而全的万能工具


    对于生产力来说,这三点都比一个万能、灵活的Agent 更为重要。




    当然模型能力越发强大的前提下,整体自进化的日子也肯定会到来


    另外我觉得这帖可以去掉等级

  • Skye 06-01 16:50
    10

    整个平台最外层有一个观察者Agent,



    可以试试我这个, 会话中自动迭代创建的子Agent只是临时的, 只有能演化出满足任务需要的Skills和Tools后才会被观察者固化, 并且使用A2A协议独立可执行程序也能避免影响其他Agent

  • Zendphp 06-01 16:51
    11

    单Agent配置多skills 与 多Agent配置单skill ,

    有时感觉只要跑顺,理论上也大差不差吧,

    然后就是一个后续拓展及维护(可能单个的更好调测优化吧)

    mark下

  • hywj99 06-01 16:55
    12



    以 openclaw 通用智能体为例 通过 实现 agent 编排层 来做的任务流水线

  • 擎伞驻阡陌 楼主 06-01 16:59
    13

    我这里对上下文和工具性的理解是,一些封装的机械检验应该是有一套逻辑被特定的agent进行维护,也就是agent特化,把整个agent概念封装为当前类似skill的形态,在这个agent下专门负责一些专有的skill或者是其他机械性工具。这样可以实现上下文隔离的同时,管理这些工具

  • hwang 06-01 16:59
    14

    这个思路好像跟站里一位佬分享的差不多,不过他是“万物基于skill”,然后去自进化。

    如果我没理解错的话



    本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:

    我的帖子已经打上 开源推广 标签: 是
    我的开源项目完整开源,无未开源部分: 是
    我的开源项目已链接认可 LINUX DO 社区: 是
    我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是
    以上选择我承诺是永久有效的,接受社区和佬友监督: 是

    以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出


  • Skye 06-01 17:08
    15

    方向是一样的, 只是实现思路不同, 我更多的是想彻底释放AI的主观能动性, 默认只有bash和文件读写工具, 剩下的招聘一个会的AI来搞, 它自己给自己创建Tools和Skills, 然后不断试错直到完成任务, 最后固化成A2A的独立程序


    后续计划给HR Agent加上绩效和开除能力


    真要用于生产的话不太可控, 方案太激进了

  • Yostia 06-01 17:10
    16

    我个人认为这种形式算是harness实践的范式吧,每个agent的上下文都受分发任务的main agent管控,比如evaluator agent,repair agent,vertify agent等等,他们位处工作流的不同节点,肩负不同职责,拥有不同的工具箱,也拥有让task状态机更改的不同权限。

  • askylin 06-01 17:12
    17

    也有研究在研究改进架构本身的自进化,比如arxiv这篇很细的论文有提到[2605.22794] MOSS: Self-Evolution through Source-Level Rewriting in Autonomous Agent Systems

  • 擎伞驻阡陌 楼主 06-01 17:13
    18

    这个思路很有意思啊,有代码能看看吗

  • yingnvwuyan 06-01 17:18
    20



    目前我做的这个项目不知道是不佬说的意思,还差一点收尾

* 帖子来源Linux.do
返回