官方 grok-build 摸鱼幻觉拉满,Claude Code 一开就正常了

机器仙 2026-09-09 12:03 1

最近一直在用自建的 Grok2API,模型走 gpt-4.6,线路全挂动态家宽 + 质量守护。日常写代码、画 SVG 都挺稳,体感就是个能正经干活的模型,没啥槽点。


这两天换成官方 grok-build 1.05,直接人麻了:



  • 疯狂偷懒,能少写就少写,能敷衍就敷衍

  • 幻觉特别严重,一本正经胡说八道

  • 任务完成度肉眼可见地差,跟前面判若两模


后来切到 Claude Code,老老实实调 plan mode 干活,立刻恢复正常——该规划规划,该落地落地,不再摸鱼。


这就让我有点懵了:现在外面反代出去的 grok-build,跟正版官方到底差了多少?

是模型本身就这样,还是反代链路被动手脚了(截断、量化、system prompt 被改、上下文被吞)?


想问问各位 Super / Heavy 的佬:



  1. 你们官方 grok-build 用着体感怎么样,有没有同样的偷懒 + 幻觉?

  2. 有没有人拿 Claude Code 对同一套任务做过对比?

  3. 自建 Grok2API vs 官方,差距是否真有这么夸张?

最新回复 (7)
  • yanjue110 09-09 12:18
    1

    还没实际使用,今天才尝试使用,你这么一说我也有点担心了

  • 时牧 09-09 12:23
    2

    幻觉率高不愿意调用工具,都是降智表现

  • darkbug 09-09 12:25
    3

    Grok2API,模型走 gpt-4.6



    自建Grok2API,模型走 gpt-4.6正常,换成grok-build不正常。组合起来看不太懂。

    意思是用的是codex 走 gpt模型正常,但是grok build走gpt模型不正常吗?


    我目前用grok build + grok 4.6 xhigh,在自己有明确意图的时候去实施任务感觉还行,速度挺快,指令遵循度也挺高的。

    但是grok build 里面的 /goal不太行,很偷懒,运行一两轮就停了。

  • crispyctt 09-09 12:29
    4

    我没看懂什么意思,你后面是用了官方订阅直接登的grokbuild吗

  • thirking 09-09 12:33
    5

    直接登自己账号没有遇到过降智情况,我的代理只是普通的公司购买 vpn

  • jcc 09-09 12:36
    6

    heavy 官方直接登录的,这几天慢是真的


    行为看起来没什么问题


    但是,昨天下午glm高峰期换了grok ,结果写了一大坨屎,让glm清理了一上午了

  • 一叶寻尘落枫舞 09-09 12:38
    7

    你延迟不高么,最新刚更新了一下模型 还不知道能力如何。

* 帖子来源Linux.do
返回