在使用 trellis搭配 gpt 时,分配子代理所使用的模型和推理强度探讨

Azheovo 2026-07-15 11:37 1


系列文章

更新日记:
2026.7.14 11:37:解决主代理长时间等待子代理问题。添加AI帮忙配置的更开箱即用的方式,请重新复制交给AI配置。

太长不读:
直接复制下列提示词交给codex配置

帮我先备份 codex 相关配置文件,再完成下面的相关配置修改:

~/.codex/config.toml 增加/修改下面的参数:

[features.multi_agent_v…


在被 codex 折磨了一天,十几个小时一个模块都没开发完的情况下,想到了配置子代理的模型分配。


我是使用的 trellis 进行开发,比 superpowers 好用很多。参考了这位大佬的分享后,我为在 codex app 中使用的 trellis 配置了子代理的模型路由。












































第 1 列 第 2 列 第 3 列 第 4 列
角色 模型 推理强度
Trellis-主会话 gpt-5.6-sol xhigh
Trellis-research gpt-5.6-terra low
Trellis-implement gpt-5.6-sol high
Trellis-check gpt-5.6-sol high

虽然大佬建议是 调研用 luna,但我担心 trellis 的调研可能比较重,luna 可能不能胜任。然后实际的开发模型又不敢用太弱的,担心出问题。


我配置好后就和大家来分享了,还没有来得及实际使用,不知道这样效果如何。想看看佬们有没有什么经验

最新回复 (13)
  • jisheng 07-15 11:39
    1

    我用trellis 上下文爆了后自动压缩 压缩完它又重新读规范 又占一大段上下文 做一个任务巨慢 经常压缩上下文

  • Azheovo 楼主 07-15 11:41
    2

    这个确实恶心,我都想把主会话路由到 opus 了

  • jisheng 07-15 11:44
    3

    你也遇到这个问题了吗 我一个中小任务 搞得巨慢 每次压缩上下文之后 感觉又是重新来 好烦

  • kamu97 07-15 11:46
    4

    主会话,free号池的terra-xhigh,implement公司买的ali token plan的glm5.2,check qwen3.7max,research dsV4Flash(很少会用到research子代理)。主代理要规划任务grill-me需要智商在线,实现和检查代理最好是完全不一样的模型感觉能真的检查出问题而不是白跑。用ali token plan的国模不是因为它们强,只是迎合下公司那些喜欢看使用量的管理层罢了

  • NukaColaM 07-15 11:50
    5

    规划dsv4pro,执行dsv4flash,我已经用了快一个月了。当然还不能说很好,但我觉得能用。

  • Azheovo 楼主 07-15 11:51
    6

    虽然不算重新来吧,但每次加载然后又复述一下任务看着也很烦。慢的很

  • Azheovo 楼主 07-15 11:52
    7

    佬们自己有技术哪怕模型差点自己也有能力判断,我不是技术出身,很多问题根本看不出来,所以完全不敢用差的模型,嗐

  • jisheng 07-15 11:54
    8

    我用grill me with docs 对齐一个需求 上下文压缩了两次 我真服了 第一次需求对完差不多了 上下文满了自动压缩后 又开始读规范 不知道在干些啥 一个小时了 还在跑

  • Linus Torvalds 07-15 11:54
    9

    太心累了,就凭gpt动不动降智,max以下那短小的思考预算,一坨,全部max

  • Azheovo 楼主 07-15 11:56
    10

    那有点慢的耗不起了,一天 4 个 plus 也不够我造啊

  • Linus Torvalds 07-15 11:58
    11

    我之前用terra-max写的代码,用sol-max还能检查出一些问题呢


    只能说,把research和check要拉高,implement可以适当降低

  • 冉淦元 07-15 12:02
    12

    来试试Aegis吧:【开源推广】Aegis:AI编程200k Star开源加强版,融入架构驱动与哲科思维,自动提升代码质量 - #265,来自 user542




  • dc14 08-06 04:50
    13

    佬你用下来效果咋样啊,为了省点token想用luna max做implement子代理^-^这样开子代理是不是会比单用一个主会话消耗高呢?上下文压缩之后trellis自动注入的情况我也有,挺恼火的

* 帖子来源Linux.do
返回