想问一下各位佬关于claude及codex各项工作的模型选用

ironfish 2026-09-02 07:59 1

目前整体模式主要是Claude为主agent,claude都开high

主脑用Opus 5

所有subagent用sonnet 5

coding的时候是subagent调用codex sol high 来做

review和explore都是走双路(sonnet+codex sol high)


如果切到fable 就是把opus替换成fable


但是听到有佬介绍说fable的编程能力强悍

如果把implementer换成fable 5.1 大家感觉如何 (因为每一次implement的动作其实是独立上下文,就感觉很贵.)

还是说这个环节不走subagent,直接在主线中让主脑直接落地?(那就要占用主线上下文)


我一般上下文手动大致200-300k就压一次,自动压缩点设置在360k,大致330k就会进入自动压缩(这个是为了跑/goal的上限压下来),但是会话启动的第一轮探查后基本就90k了…感觉如果全塞主脑里头没跑几轮就得压缩


求讨论!感谢!

最新回复 (7)
  • OctoberSama 09-02 08:01
    1

    干活的subagent用最强的模型说不定会合适 毕竟对上下文影响小

    但是反过来 得到的信息也会有不少失真

  • ironfish 楼主 09-02 08:12
    2

    查了claude docs, 其实subagent的会话注入和主脑几乎一致,这就导致了等于每一个subagent就得开头90k的cache 写入… 感觉不是特别赚…啊

  • OctoberSama 09-02 08:16
    3

    好像是啊 我就说为什么消耗这么快

    现在好处只剩一个不污染上下文了

    我觉得这方面可能有待harness改进 毕竟对于查询代码的资料的subagent来说基本上不需要直接读取主agent的上下文

  • ironfish 楼主 09-02 08:20
    4

    嗯,他不会把主脑上下文拉过来,除非你用/fork啥的 但是每一次启动费的token其实很多,claude.md, rules, skills, 还有system prompt等

  • OctoberSama 09-02 08:22
    5

    这样的话其实就还好了 如果给子agent不一样的系统提示词 还有其他限制就比较好了

  • 91kevinshi 09-02 08:25
    6

    Fable 只规划和调度,干活全都交给 gpt-5.6-sol

    我连 sonnet 都不用

    opus 也基本不用,Fable 额度用完了基本做不了复杂任务

    简单任务 opus、gpt 都来都行

  • ironfish 楼主 09-02 08:35
    7

    那explorer和review完全都给codex么? 干活交给gpt的话是说用主脑直接spawn codex来做?

* 帖子来源Linux.do
返回