GLM 5.3Flsh 实际水平如何?

Ai777 2026-10-02 04:37 1

我上个月开的是max的智谱 这个月开的是最便宜的那个 用5.3flash还能扛一下额度 但是感觉真的好笨啊 但是5.3也很离谱 没有视觉模型 顺便问问为啥国产模型那么多都没有视觉呢?

最新回复 (2)
  • for_the_zero 10-02 04:44
    1楼

    别开最高思考,token烧得飞快,实际水平一般,干点小项目完全够用

  • Noale 10-02 04:54
    2楼

    慢是慢了点,但效果不错,现在一直在用。(主要是鸡蛋发的多)

    说缺点就是幻觉严重

    它会编造 URL 和文件路径,或者派发指令时没有探索过,导致文件夹里面其实根本没有子代理要的东西。

    在读取网页的时候,如果URL是编造的,它会反复试错(试错的URL也是编的)。


    最近的情况:

    它会在长上下文后突然发疯,然后说自己这里有问题,环境返回出了不应该返回的内容(实际上目录本身并没有错,只是它忘记了自己的命令)。

    但这种突发幻觉,不算太常见,只是最近偶尔遇到。


    我也不是让5.3 flash去做那种小活,现在的仓库主要还是GPT-6给出方案,5.3flash完成方案后审查。


    它没有Gemini 3.8 flash那么谄媚。我也用过最近的minimax M3.1 flash,令我反感的是,M3.1在没有查证的情况下多次果断的“确认”。我让它查文档,它说文档没有收录,但它根本没有查过文档。


    当然,这一直是5.3 flash和GPT-6打配合,真要它单干…没把握。

* 帖子来源Linux.do
返回