狂烧33亿Token实测!GPT-5.6-Luna无限火力打法

Ryunn4 2026-08-04 10:21 1

省流版:Luna Max 垃完了。


Luna降价后流行了一套「无限火力」打法。这套打法的思路是Sol做主会话调度,Luna做subagent执行

这套打分的理论基础应该是站内经常看到的雷达网站IQ评分。Luna max 智力分值103,甚至超越Sol high版本



具体提示词如下:


在以下路径创建一个名为 luna_worker 的自定义 Agent:\~/.codex/agents/luna-worker.toml
使用以下配置:model = "gpt-5.6-luna",model_reasoning_effort = "max"
请为这个 Agent 补充清晰的 description 和 instructions。luna_worker 只负责处理范围明确、边界清晰、可以独立完成的委派任务,不负责修改整体任务目标,也不要自行扩大工作范围。请保留我现有的其他 Codex 配置,不要覆盖或删除无关内容。
创建完成后:
1. 根据我当前安装的 Codex 版本检查配置格式是否兼容;
2. 展示本次修改产生的 diff;
3. 确认配置有效;
4. 后续需要调用子代理时,优先使用 luna_worker。

周末我自己蹬了33亿Token,几点感悟:

1.Sol搭配Luna的模式能省一点,但不多。Sol在调度时也会狂烧token。在token1:1的情况下价格差不多是25:1.额度依旧会飞速见底。

2.在 OPENAI的官方描述中"Max 会让所选模型有更多时间针对单个任务进行思考和推理",因此完成任务的时间会大大拉长

3.即便是开了max,由于模型的分工Luna本身激活的参数就很小,并不适合复杂任务,使用中目标太大容易产生bug造成返工。

4.为了节省额度,我更推荐全程Luna max,拆分任务颗粒度24小时长时间运转时效性不强的任务。经过实测验证,即使IQ分差不多。Luna MAX体感就是很差。因此不能对其抱有太大期望


刚居然给举报了,补上AIGC检测截图

最新回复 (12)
  • Nika 08-04 10:47
    3

    因此不能对其抱有太大期望



    费token,还有就是巨慢无比,时间长了不止半点,一个任务都能干上大半天,其实说白了就是时间换效果了,不过好在价格便宜,薅羊毛挺好的

  • 玉树临风美少年,揽镜自顾夜不眠 08-04 10:50
    4

    感觉还是挺费token的。

    1是子代哩缓存命中比较低(短时任务,长时任务高,但是长任务用luna就背离核心了把?)

    2是sol做调度也是定时查结果,有时还会任务溢出。


    个人体验下来不如单一。。

  • terr 08-04 10:54
    5

    个人使用体验下来,单个短小的任务,luna max还行,稍微长一些的任务就会跑偏

  • starpipi 08-04 11:18
    6

    很巧,我从上周开始就让团队小伙伴一起在测试验证类似用法。那时候还没有各种铺天盖地宣传luna_worker的文章。


    核心原因还是重置卡基本消耗完了。 我们整个部门20个人一起用x20,平时2-3个人高强度,其他人还好。 用量大的时候1天一个重置卡。 5.5的时候三天一个重置卡。

    所以很早就在考虑没有重置卡以后如何保用量不炸能够持续产出了。


    无论是main_agent——Luna(max)+sub_agent——Sol(high)

    还是main_agent——Sol(high)+sub_agent——Luna(max)

    实际本质差别不大。综合时间也差不多。

    我本质上是要求他计划和审核review时用sol。实现代码用luna。简单任务没啥大毛病,但是细节还是有很多要优化的。


    我现在更倾向于用sol做计划+grok4.5做实现。整体速度更快。质量也比luna高。但是体感会割裂一点。


    今天开始准备用deepseek-v4-flash对照一下,看是否能跟luna产出效果基本一致。如果可以,也是一个比较好的替代。


    毕竟我们一个X20目前没重置情况下不够用了。

  • kinghe 08-04 11:21
    7

    坐等大佬分享实验后结果,小弟们好照抄作业

  • 擒狩 08-04 11:31
    8

    除了消耗比较低,适合在额度紧张的时候过度用,就是拿时间来换,小任务简单任务还好,要是那种长任务返工的话头都疼^-^之前跑任务,用sol最长几十分钟,昨天晚上测了一下Luna Max挑了个任务稍微长一点的,我预计大概可能在50分钟或者45分钟,结果最终跑了一个小时40分钟^-^,然后就是现在我正在返工当中^-^,消耗的话呢,我昨晚是45%然后到现在才39%消耗是低,但耗的时间太长

  • 擒狩 08-04 11:32
    9

    对的佬友,Luna Max时间太长了,返工就头疼了,deepseek-v4-flash,目前也在考虑这个,自从正式版出来之后,速度明显和智商都上来了

  • Karioz 08-04 11:40
    10

    Luna Max真有Sol xHigh的水平?我实际用起来怎么感觉还不如Sol medium呢

  • starpipi 08-04 11:45
    11

    最近几天sol medium降智了。 前段时间一直是我主力,但是现在不行了 必须用high。

    至于luna max 是这两天爆种了。。

  • Ryunn4 楼主 08-04 11:50
    12

    deepseek-v4-flash 我最近几天也在高强度用,体感和 Luna MAX 差不多,属于左右脑互搏。

    Luna 写的 DSflash 能审出一堆 bug

    DSflash 写的 Luna 也能审出一堆 bug


    真如上面佬友总结的,时间换空间。多 review 几遍试图提升质量。


    另外和任务目标也有关,如果有明确的验证手段能够形成循环,完成的质量会能够接受。如果单开发功能没有明确验证手段,bug 就激增

  • 远坂凛的宠物 08-04 11:52
    13

    我体感sol不适合做规划,对比力工luna就是个𡘙夯工模型,不是研发攻坚没法规划的任务,找个外置大脑gpt的表现会好很多。作为力工的sol和luna max其实区别不大,sol的长处是给它难题它会自己一直想办法试错

  • ba lao 08-04 12:10
    14

    因此不能对其抱有太大期望



    体感跟V4 flsh差不多,估计是因为参数量导致的问题。

* 帖子来源Linux.do
返回