Grok 4.5 流口水,可能真不是马斯克给降智了

Portainer 2026-07-30 21:33 1

先说结论:


我感觉 Grok 4.5 在 OpenCode 里表现得很懒,主要问题可能不在模型,而在 Agent 自带的提示词和工具调用逻辑。


我的测试环境没变,都是自建 Free 账号池,通过 Grok2API 导出 Grok 4.5,只是分别接到了 OpenCode 和 Hermes 上。


先说 OpenCode。


刚开始用的时候,我一度以为 Grok 4.5 被严重降智了。不是完全不调用工具,强行要求之后也会动,但整体非常被动。


经常是这种回复:


你运行一下 XX,看看是否正常。

你执行这条命令,同时观察日志。

把终端输出复制给我,我再继续分析。


问题是,这些事情它明明可以自己做。


我已经明确告诉它可以直接操作终端,也要求它自己排查,但它还是习惯把命令发给我,让我执行,再把结果贴回去。整个体验很像在网页端问答,不像一个能自己干活的编程 Agent。


后来我把同一个 Grok 4.5 换到了 Hermes。


差别非常明显。


我只说了一句:


Debug,直到项目跑通。


然后它就开始自己读代码、跑命令、看日志、改代码、重新测试。报一个错就修一个,修完继续跑,基本不需要我在中间帮它执行命令。


实际用下来,主动程度和我之前用已登录 Codex 的 GPT-5.6 差不多。


所以我现在比较倾向于认为,所谓 Grok 4.5 “流口水”或者“很懒”,不一定是模型本身的问题。Agent 怎么写系统提示词、怎么描述工具、允不允许模型连续执行任务,影响可能比想象中更大。


至少在我的环境里:


OpenCode 下的 Grok 4.5 很被动,换到 Hermes 后马上正常。


大家如果也是用 Free 号池接 Grok 4.5,遇到流口水了可以换 Hermes 试试。

最新回复 (3)
  • wq287627997 07-30 21:33
    1

    我怎么感觉还行

  • NeverMind 07-30 21:35
    2

    可能是IP问题

  • yoniku 07-31 00:02
    3

    你换个IP就不流口水了,切节点就行。

* 帖子来源NodeSeek
返回