分享重度使用半年以上国产模型的感受

gorgias 2026-09-09 23:48 1

TL;ND: GPT > Opus > GLM5.3 ≈ Kimi K3 > GLM 5.2 > DeepSeek V4 Pro >> GLM 5.3 Flash ≈ DeepSeek V4 Flash 其他没用过


用过Opencode, OMO,Claude, Codex,大部分源码都读过,也自己写过。

Cursor最强,但是埋点太多,无法信任。

Claude ^-^行为,无法信任。

Codex也不少埋点,最后用Clash拦截了。

TRAE, Kiro, Antigravity坐一桌,kilo, Cline啥的就更别提了。


最后只用KIMI Code和OMP,如果有人研究过KIMI Code,应该能感觉到这个产品的用心。


GLM是我最喜欢的模型,比较实在,除了最近GLM5.3-Flash过度吹牛逼,GLM5.2比Opus4.6差不少,连个Exploit都写不好,逆向也有些笨,但是完全可以接受!其实5.2-5.3已经可以充当生产力了。


MINIMAX M2.5时期用过,吹过头了,极度智障,无好感,但是据说H3和M3都不错,M3我专门拿来识图了,效果不错。


KIMI 2.5/6时期试过,用起来没什么特点,但也不会烂,直到KIMI K3出来,当时拿它逆向分析某个硬件加密算法,耗了大量token,居然破解出来了,非常惊艳。KIMI K3就比满血的GPT5.5差一点点。KIMI K3 搞不定的,做个Handoff,临门一脚给GPT就能解决。


字节:豆包日常用还行,但是API就真的喜欢左右脑互搏,无法信任


阿里的Qwen,我喜欢用它们的embedding模型,当然本身也不错,用过3.6,没法充当我的生产力。3.7据说进步了不少,3.8又很多人夸,但我不会再去试错。


我一直用DeepSeek干杂活,因为总是不太靠谱,不能只看跑分。3.0执行toolcall是不太准确的,但是正常的判断逻辑还是有的,到了3.2更加准确,我一直拿它来自动跟进最新的CVE Project.因为CVE评分非常不准确,特别是NVD的评分,DSv3评的准确多了。到了DSv4, 反而没任何进步,有些时候还更笨,评分也不准确了,不知道什么原因,无法信任大肥鱼,这也是我只让DeepSeek打杂的原因。


这两个无任何好感




  1. 腾讯系的直接拉黑,不管是模型还是Agent,不知道有没有人记得腾讯那个work什么东西刚出的时候,所有数据都放在桶上,随意翻阅; 早期腾讯云有个云IDE也是随便蹬的。




  2. 小米系的直接拉黑,当初MIMO一出我就测了,他们的云agent api key当时是写死的,可以疯狂薅。toolcall非常糟糕,问它是谁,说自己是Sonnet 4.5,啥都干不好,吹牛第一名,这模型我后来再也没碰过,就和这公司所有产品一样,无法信任。



最新回复 (19)
  • YangG 09-09 23:52
    1

    佬有用过zcode吗,相比于kimicode体验如何

  • wayned 09-10 00:02
    2

    zcode 只有客户端,没有 cli,kimi code 只有 cli,两个刚好不是一个路子,看你习惯了

  • david vabi 09-10 00:04
    3


    1. 小米系的直接拉黑,当初 MIMO 一出我就测了,他们的云 agent api key 当时是写死的,可以疯狂薅。toolcall 非常糟糕,问它是谁,说自己是 Sonnet 4.5,啥都干不好,吹牛第一名,这模型我后来再也没碰过,就和这公司所有产品一样,无法信任。



    上个周末撸GLM 5.3 flash,体感还不错哦,有点想用回来GLM。佬现在主力IDE是kimi code?

  • 奕凰轩祭侍 09-10 00:07
    4

    跟佬体感一样,目前编程最夯的还是gpt,国模就kimi和glm能真正上生产

  • gorgias 楼主 09-10 00:07
    5

    zcode太多埋点了,而且不开源,直接放弃了

  • VictorQuqi 09-10 00:09
    6

    咋不提肥波,确实是



    其他没用过



    吗(

  • gorgias 楼主 09-10 00:09
    7

    正式工作的话,GLM5.3纯辅助是完全没问题的,体感肯定是好的,但不能碰重要的工作。主力IDE是KIMI和OMP, Codex只用GPT.

  • TOT 09-10 00:09
    8

    奇怪,网安任务你怎么用GPT和Claude?

    还停留在4.6 opus?

  • pkcloud 09-10 00:10
    9

    国模我都是用来问点生活小知识,或者在hermes里用下

    生产力一直用GPT和grok4.6,主要国模起来后性价比也不高,也不想尝试了

  • gorgias 楼主 09-10 00:10
    10

    肥波



    这里不是说到国产模型? 你咋不说我不提Astra?

  • 冬月 09-10 00:10
    11

    5.3flash的体感居然比不过dsv4pro吗 我也算是都用的重度用户吧,使用体感上牢pro总搁那吃白饭(悲) 干活能力不如5.3flash的

    这个flash佬是在哪使用的,要是还缺token 能不能赏脸试试我这边的自部署满血 给个1亿的额度蹬蹬说说体感 根据佬你的体验 我好决定用哪个

  • gorgias 楼主 09-10 00:11
    12

    曾经没那么严格,网安任务现在一点都干不了了,不过KIMI K3和GLM5.3也可以干

  • gorgias 楼主 09-10 00:12
    13

    我也是私有部署的满血版,谢谢佬的慷慨,这两个模型我都无法信任,我不想被迫回退代码 ^-^

  • 冬月 09-10 00:13
    14

    好家伙 这么拉吗合着,我得重新评估一下我这边用5.3flash写的代码了 ^-^

  • gorgias 楼主 09-10 00:13
    15

    5.5和4.6时期还是啥都能干的

  • gorgias 楼主 09-10 00:14
    16

    可能我的比较复杂,我是街机模拟器开发,里面很多3D兼容,还有各种控制器,游戏复杂状态机的东西。

  • ciarany 09-10 00:14
    17

    omp和kimi code比opencode实际体验中好在哪些点

  • gorgias 楼主 09-10 00:14
    18

    那肯定是omp和kimi code了。OpenCode如果不加OMO那没法上桌了

  • HarmonyOS 09-10 00:15
    19

    感谢分享,去下载个kimi code来试试看

* 帖子来源Linux.do
返回