〖开源〗Codex PROVE 更新:让 Codex 开启 “加特林模式”,接入 GPT-6,Sol / Terra / Luna执行,成本节省预计少 60%+

xkk 2026-09-27 20:37 1

本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:



  • 我的帖子已经打上 开源推广 标签: 是

  • 我的开源项目完整开源,无未开源部分: 是

  • 我的开源项目已链接认可 LINUX DO 社区: 是

  • 我帖子内的项目介绍,AI生成、润色内容部分已截图发出: 是

  • 以上选择我承诺是永久有效的,接受社区和佬友监督: 是


以下为项目介绍正文内容,AI生成、润色内容已使用截图方式发出




让Codex自己分工,别做什么都用最贵的模型。


PROVE 是一个给 Codex 使用的模型分工技巧。核心很简单:Astra 主控、Sol 专项、Terra 常规、Luna 批处理。主控负责理解、拆分、分配和审核,具体执行排序合适的子代理。


改个文案、修改个小问题,当前Codex直接做。遇到跨模块开发、复杂排查,再拆掉做。你不用自己切模型,也不用挨个给子代理派活。


2026-09-27 更新


前面有佬反馈,流程维护开销太大,经常 blocked,还得反复批准。我当时说再优化一下,这次把模型分工和这些问题一起改了。


现在是:



  • Astra 主控:理解需求、拆任务、分配和审核。

  • Sol 专项:处理难题、复杂排查。

  • Terra 常规:日常开发、测试和集成。

  • Luna 批处理:做规则明确、重复性高的任务。


小任务还是当前 Codex 直接做,值得拆的再拆,没必要每次四个模型全上。


这次主要做了几处减法:



  • 减少重复的身份确认,少跑空流程。

  • 已授权的本地修改和测试,遇到可修复的问题继续处理,减少不必要的 blocked。真正需要新权限或你做决定时再问。

  • 独立任务可以并行,有依赖的按顺序,同一个文件只交给一个执行者。

  • 借鉴 Ponytail,优先复用项目已有实现,少加没必要的依赖和抽象。


费用也按新模型重新整理了。按 README 的示例配比和编排开销,同一组 token 预算,全程 Astra $15,PROVE 分工约 $5.66,预计少 62.3%。


这里比的是 token 费用,不是运行速度,实际节省取决于任务分配。计算方式和假设都放在这里。


用法没变,任务前加 codex-prove。旧用户更新仓库后,记得重新运行安装脚本,再开新会话。


2026-10-02 更新(v1.2.0:Sol 优先,按需分工)


这次把主力换成了 Sol 6.1。之前是 Astra 主控、四模型分工,现在反过来:Sol 做主力完整任务,Astra 只在难题或必要的独立评审时只读介入,Luna 做规则明确的批量活,Terra 退出默认分工(四个角色 ID 保留,以后换模型不用改入口)。


现在是:



  • Sol 主力:完整任务自己规划、实现、检查,有用的协调也归它;不拆碎。

  • Astra 按需:一个明确的难题,或有必要的独立风险评审;只读,不做例行签字。

  • Luna 批量:规则明确、结果可客观检查的机械任务。

  • 小任务还是当前 Codex 直接做;不设固定模型配额,值得拆、能独立推进的才拆。


几处收紧:



  • 同一个写入范围同一时间只有一个负责人;交接先停旧写入、验改动,再交新负责人。

  • 验证过的证据相关任务可复用,不重复跑;外部动作有明确的恢复边界。

  • 计量更严:区分 root-only 和全程覆盖,重复、冲突、缺失的事件单独识别,不把已知成功的子集包装成完整账单。

  • 费用示例按 2026-10-01 Codex Standard 费率重算:同一组 token 预算,全程 Astra 375 credits,PROVE 分工约 64.5 credits,少 82.8%。这是预算示例,不是实测节省。


验证:169 项本地测试通过;Ubuntu / macOS / Windows 8 个 CI 矩阵全过;三组单任务对照 19/19 通过,PROVE 比普通 Codex 的 API 等价估算低 13.86%、快 10.20%(单例观察,不做普遍结论)。


用法没变,任务前加 $codex-prove。旧用户更新仓库后重跑安装脚本,再开新会话。


更新日记


2026-10-02


发布 v1.2.0:Sol 6.1 做主力,Astra 按需只读介入,Luna 做批量,Terra 退出默认分工;明确唯一写入负责人与交接顺序;费用示例按新费率重算。


2026-09-26


升级 GPT-6 模型分工,减少重复确认和不必要的停顿,完善跨平台安装、备份与恢复检查。


2026-08-20


发布 v1.0.0,更名为 Codex PROVE。完善任务分工、文件所有权、结果审核和长任务恢复。


GitHub:yehyakin/codex-prove


感谢佬们的反馈,尤其是前面提到的流程开销问题。省额度的同时,也得让人用着省事。

最新回复 (4)
  • 二次元糕手 09-27 20:39
    1楼

    感觉很不错,跟我现在用的分工差不多但是更细致

  • 西行寺幽幽子 09-27 21:57
    2楼

    看起来不错,有几个问题:

    1、调用不同模型是直接通过skill分配吗?假如接了中转站的api,在Codex配置文件里面设置了 Astra 模型,也会调用其他模型吗?

    2、有些中转站的模型不全,会导致出错吗?

    3、与其他 skill/钩子 会有冲突吗?例如 trellis、brainstrom 这类也是全局规划任务的skill。

  • xkk 楼主 09-27 23:37
    3楼

    1、Skill 负责分工,真正切模型的是 Codex 的子代理机制。主会话配置 Astra,不代表子代理只能用 Astra;需要分工时,会按 Agent 配置请求其他模型,也不是每次都把四个模型叫出来。按默认继承方式,请求仍走你配置的中转,前提是中转支持对应模型和调用参数。


    2、模型不全,调用到缺失模型时确实可能报错。如果必须用某个模型却调不到,那部分就得停下来。另外,中转后台实际提供什么模型,Skill 本身无法替它保证。


    3、可以搭配,但不能让两套流程同时指挥。 PROVE 需要显式调用,本身不加常驻钩子。不过 Trellis、brainstorming也有自己的规划和确认流程,直接叠加可能重复规划、反复确认。我建议先完成需求和方案,再明确交给 PROVE 分配执行

  • omygod 10-05 02:56
    4楼

    感谢佬友分享, ^-^

* 帖子来源Linux.do
返回