世界就是个巨大的草台班子,人人都说Hermes费tokens,可到底是为什么呢?打开一看惊呆了...

thehuan 2026-06-13 23:29 1

玩了半个月Hermes了,发现消耗确实高,但因为接的deepseek v4 flash,打些小杂,每天耗几千万tokens也没在意


结果今天只让其干一件事,安装部署一个项目,结果一直在跑,不知道在干啥,跑了很久才跑完去查api这一个部署跑了我千万tokens!


根本不对劲,整个对话就几轮,但一直在调用工具一直在跑跑了很久.


我于是查原始请求,结果打开一看惊呆了


因为要部署于是调用tools进行了命令安装,整个安装下载过程,被当做上下文回传了


然后我网络出现问题,下载中断,于是再次下载,安装日志x2,又失败,又重复,如此循环,上下文就一直累积,并且一直重复请求


最终安装成功后,干了我这么多


关键是这样的行为还重复了两次!这才跑了我千万tokens


我是真的震惊了,为什么有agent会拿终端打印不过滤的啊?!还是说过滤失效了?


—后续补充—


这是Hermes的官方限制,对工具调用返回只做了这些限制























max_bytes 50,000 字符 终端 stdout/stderr 总长度上限(head+tail 截断)
max_lines 2,000 行 文件读取的分页/截断行数上限
max_line_length 2,000 字符 单行长度上限,超长行会被 [truncated]

关键是根本没判断工具调用次数和重复次数,我上面那个例子就是典型,安装失败,重新安装,那个下载记录就在一次又一次的叠加到上下文中!


我去问了gpt,说claude 、codex这些早就有对工具返回内容的筛选限制了,还有什么流式筛选,根本不会出现这种下载日志…


—继续补充—


我稍微调研了下,问claude code如何处理


这是geimini的分析


这是来自https://zread.ai/leaked-claude-code/leaked-claude-code 基于源码的分析,应该是准确的


codex gpt的回答更是复杂,给我扯出了什么八重筛选机制,总之就是,主流的cli都对tools调用返回进行了大量的限制

但很显然Hermes做的非常粗糙,才导致这种结果

最新回复 (11)
  • 小鱼 06-13 23:32
    1

    我还没用过,看到你的帖子,hermes要考虑考虑了

  • 乄丿 06-13 23:34
    2

    不好~!通知下去,我们偷tokens的事情泄露了

    告诉那帮叼毛,少偷点,偷太多会被发现


    其实也不耗费什么,有缓存计费,都不用多少钱

  • MonoEven 06-13 23:35
    3

    这就不得不提我用hermes改一个网站重定向,自顾自的烧了20刀 ^-^

  • Ougi 06-13 23:36
    4

    之前用了一个pdf翻译服务也是这样, 跑了半天用了20m token, 最后发现是反复生成pdf编译失败 ^-^

  • peterwhite 06-13 23:37
    5

    说明了时不时分析一下 token 的使用情况很关键,鬼知道上下文塞了啥不该塞的东西

  • henrythomas 06-13 23:40
    6

    模型注意力和智力不行,使用工具能力也不行,这么简单的任务直接gpt5.5 midhigh都能很好完成,Hermes框架得配置高智力的模型在工程实践。搞不清直接用龙虾和Hermes的。要本地有codex app, 放服务器跑codex也行,远程控制也可以用codex app,都能很好把控要做的事情。

  • 匿名 06-13 23:40
    7

    我觉得吧,这不算是hermes的问题,毕竟输出是很重要的,ds没选择改善指令防止非必要输出



    关键是根本没判断工具调用次数和重复次数



    我记得hermes是有工具重复调用判断的,反复使用同一工具就会提示模型。谁知道输出里面是否是报错还是垃圾信息,总不能怪hermes吧。我也在哈基米遇到过这个问题,其他模型没遇到过

  • MonoEven 06-13 23:44
    8

    模型配多强都一样,我hermes用的5.5马粮,代码让它调度codex-cli,一样烧token,一样反复绕路,大概是3kb的记忆和鱼没什么区别了(换完hy-memory勉强像一头正常马了)




    hermes最大的问题是定时任务会在会话里无限污染上下文 ^-^

  • 深念 06-13 23:44
    9

    我发现hermes比claudecoed codex 更吃模型,除非你是无限token的小模型干体力活。不然的话,hermes配垃圾模型效果非常差, 有很多flash模型在claudecode和codex上面的表现都比在hermes里面好。我感觉是系统提示词的问题

  • leileio 06-13 23:57
    10

    我配了一个gpt 5.4 mini这个模型,不知道这个模型质量好不好

  • 康康 06-14 00:22
    11

    hy-memory你用了么佬,这个不是龙虾很容易开启么??

* 帖子来源Linux.do
返回