请求指定:
model = gpt-5.6-sol
最终公开名称:
response.completed.response.model = gpt-5.6-sol
实际运行遥测:
responsesapi.websocket_timing
timing_metrics.engine_ids = gpt56lun-codex-...
我们用不同的账号来进行了测试
pro号,区分为正价号,ios支付号,菲区号
team号,均为5xteam
plus号,正价号、首月优惠号
每一次请求都明确选择 gpt-5.6-sol,每一次最终响应里的模型名称也都显示 gpt-5.6-sol。
编写一个受控的 Codex WebSocket 客户端,把服务器发回来的每一条事件记录下来,再对其中与模型路由有关的字段进行脱敏分析。
wss://chatgpt.com/backend-api/codex/responses
这是 ChatGPT Codex 使用的后端路径
程序向服务器发送的核心内容可以简化成:
{
"type": "response.create",
"model": "gpt-5.6-sol",
"reasoning": {
"effort": "high"
},
"input": "这里是普通问题或糖果题"
}
完成响应的 response.model 全部是 gpt-5.6-sol。
在最终完成前,服务器还会发送一条:
responsesapi.websocket_timing
其中的关键字段是:
timing_metrics.engine_ids
实际看到的值会类似:
gpt56sol-codex-... 表示 Sol 家族引擎
gpt56lun-codex-... 表示 Luna 家族引擎
于是,同一次异常请求会同时留下这样的证据:
发出的 model gpt-5.6-sol
response.completed.response.model gpt-5.6-sol
websocket_timing.engine_ids gpt56lun-codex-...
这三个字段来自同一请求。前两个表示对外请求和展示名称,最后一个表示服务器报告的执行引擎实例。
实测下来,正价pro号,在并发正常的情况下,无论是什么ip,基本都不会路由到额外模型
ios也一样,菲区一开始也不会。
但是在中转站在使用的时候,这些账号的并发和额度扣的很快,返回的动态路由会被路由到luna
但是这时候确实神奇的出现了,在aws的机子上,确实部分ip可以有效的改善智商,正价pro在更换ip之后,智商确实有显著提升,aws光帆机支持重启后切换ip
但是这个确实有点玄学,不能说百分百可以实现。
team号,这个我观察跟原始的free号的注册方式有关系,如果free是走的正常注册,手动的,而不是走的协议批量注册的,也存在降智和不降智的效果,协议注册的确实比free的降智的快(但是因为5x我自己不会开,走的是号商邀请,样本不足,不能确定)
plus号,正价和首月优惠差距不大(都是手搓的,目前市面上能买的比较少,这个可能跟注册机批量注册也有关系)
部分账号降智后登录更改邮箱确实也可以解决降智,但是有的换的邮箱还是降智的。
整体的账号降智判断还是比较黑盒
但是最起码,现在可以通过timing_metrics.engine_ids来进行直接的判断,可以直接判断出你的账号是否被路由到了luna模型
“x-codex-safety-buffering-faster-model”: “gpt-5.6-luna”
x-codex-primary-used-percent: 100 ← 油表:0~100
x-codex-primary-window-minutes: 10080 ← 窗口 7 天
x-codex-active-limit: premium ← 卡的是 premium 额度
x-codex-safety-buffering-faster-model: gpt-5.6-luna ← 满了才出现的"备胎"
此外还有一些值,似乎表示openai有一个算力预算限制,当这个值是100的时候
所有的返回都是luna了
以上内容,还需要大量的账号和方式做佐证,初步方式,当做抛砖引玉了