知道为什么感觉workbuddy的v4.1 f 降智了

Xiwis Homed 2026-09-13 15:17 1

workbuddy上的v4.1f应该接的官方,但总是感觉用着不如官方


抓包看了一下,发现workbuddy上的模型阉割了模型的最大输出token


v4.1f只有32k, 对比官方的384k差了非常多


这导致在effort max或者high下,很容易被大肥鱼的雷霆思维链占满CoT, 用在推理里面的token不足



这是免费号抓包的结果,可能开会员的话有提高吗?和官方接口标记的不一致

最新回复 (9)
  • Nein 09-13 15:28
    1

    这差的也太多了吧,10倍 ^-^

  • 下班打卡 - 早退 09-13 15:29
    2

    你可以自己写它的配置文件,覆盖它的设置

  • C5Y 09-13 15:30
    3

    怪不得,我体感也觉得比官网API差很多,降智而且速度也慢一些

  • Xiwis Homed 楼主 09-13 15:30
    4

    和配置文件没关系吧,这是上游决定的最大输出,超过这个max token会被强制stop,会被卡在思考阶段

  • 下班打卡 - 早退 09-13 15:34
    5

    几个月之前,手动改 workbuddy/models.json (/.workbuddy/models.json)会有效果,现在不知道了,因为很久没用这玩意了


    参考 codebuddy 的来改:

  • Xiwis Homed 楼主 09-13 15:36
    6

    ^-^ 那应该是最近限制的吧


    我这本来就是直接测试的接口,没有通过workbuddy请求


    现在会被强制stop, reason: length

  • Nein 09-13 15:38
    7

    反代出来单独接口请求,也会有这个问题吗?大概率是线上限制了 ^-^

  • Xiwis Homed 楼主 09-13 15:40
    8

    有的,上游服务端的限制


    但这个限制和从它们接口上拉下来的元数据不不一致,元数据的max output token是128k, 实际上只有32k


    官方接口是384k

  • 人杰 09-13 15:47
    9

    有的用户测出来是64k 感觉这个会随时变动

* 帖子来源Linux.do
返回