(新证据) 内部路由暴露,ox-alpha石锤z.ai(glm)?

airline233 2026-08-23 20:54 1

省流:是在现有的



  • tokenizer特征(脏token、token数量变化)

  • 1012报错代码

  • top_p报错


三个特征之外的新特征

复现:


curl -s -X POST https://opencode.ai/zen/v1/chat/completions -H "content-type: application/json" -d '{"model":"x-preview-f-free","messages"[{"role":"user","content":"hi"}],"top_p":"abc"}'







原po Twitter @chetaslua

最新回复 (15)
  • Poco 08-23 21:01
    1

    服务竟然是 java 写的吗,这真没想到

  • ius 08-23 21:04
    2

    站内在这个模型出来当天就有佬研究并实锤啦

  • Scheme 08-23 21:06
    3

    还真是智谱的吗

    但这到底啥等级的模型啊

  • 在学OCaml 08-23 21:06
    4

    感觉可能是 glm-5.3-flash 这种, 智谱已经很久没有快速模型了

  • 在学OCaml 08-23 21:07
    5

    X 上那些 google 的内部人员明知真实情况还来凑热闹说是 gemini 真是纯小丑了, 不知何意味

  • 雨天 08-23 21:09
    6

    应该不是,智谱如果上线这么一个量级的模型,而且现在这么大的量,他的卡资源应该无法支持同时上线牛来和GLM5.3,而且牛来在openrouter的调用速度很不错。

    从资源的角度看,有可能是小米,因为现在mimo用的资源空置很久了。当然,这也是猜的。

  • 星河璀璨 08-23 21:09
    7

    可能是 GLM-5V-Turbo的升级迭代版?



    还有佬友说,是给国产卡平台适配的模型

  • smell 08-23 21:13
    8

    之前刷其他帖子和X的时候。 也有说是Gemini的 ^-^ ^-^


    还是在等等看 ,别回头有反转。

  • kero 08-23 21:18
    9

    我用opencode的时候,思考链会中断,任务还在思考,就突然停住了,完全没办法用


    其实最大的问题是opencode宣称量大管饱,随便冲,然而国模就没有算力不紧张的,你看谁家是管饱的

  • HeriX 08-23 21:20
    10

    你的论据比起楼主的根本不值一提, 而且理由也不够充分

    并且智谱的glm5.2资源这么紧张的时候(当然不是真的紧张, 你直接调用api流畅的很, 只有订阅才卡)

    还保留了一堆glm4.7 air 等等的模型

  • 白濑 08-23 21:21
    11

    和G有关系,你就说是不是吧hhhh ^-^

  • summerjoe 08-23 21:25
    12

    GLM5.3在zcode里答糖果问题最高思考能连续答错,看来是真把算力让给牛来了

  • deepcake 08-23 21:27
    13

    笑死了,你看得是营销号转的吧,原本是说朋友,传着传着就变成Gemini本人了。

    蓝V甚至能顶风作案,在同一帖子底下开始乱传话,

    我怀疑可能跟TPU有关吧?不然算力哪来的?还是美国公司根据glm微调?

  • RICK 08-23 21:29
    14

    用GLM底座,蒸馏GLM也有可能把,这个模型的水平感觉比不过5.2

  • Poco 08-23 21:30
    15

    你这啥证据。。。直接租海外的算力呗。

* 帖子来源Linux.do
返回