大家觉得当前国产模型的性能落后国外顶尖模型多少?

GLNCE 2026-06-12 13:09 1

coding方面国产最强的应该是glm5.1和deepseek4,能赶上去年同期的御三家吗?

最新回复 (13)
  • Noah 06-12 13:11
    1

    glm比5.2强点,差不多5.3-codex,ds就5.2水平

  • GLNCE 楼主 06-12 13:12
    2

    glm竟然比5.2厉害吗,那这么看来也就几个月的差距

  • 灰質心 06-12 13:12
    3

    ds4pro约莫等于sonnet4.6吧 但是细化一些的话两者各有千秋

  • Noah 06-12 13:12
    4

    是要比5.2强点,不太多倒是,5.2以上5.3未满的感觉

  • hhnnjjcc 06-12 13:13
    5

    基本上说是1.5个版本吧,最新的国模基本上比上一代差,比上上代好。当然说的是国模里顶尖的。

  • Ken 06-12 13:14
    6

    落后多少我不知道,但是我用来给团队code review的时候,海外模型总能发现一些国产模型包括glm5.1发现不了的问题。而且概率不低

  • GLNCE 楼主 06-12 13:14
    7

    那按照这个速度是不是意味着今年就能体验到国产的gpt5.5和Fable5级别的模型了 ^-^

  • OneDayLeft 06-12 13:19
    8

    GLM上下文太短了, 生成代码还行, 大型项目和代码审阅不做一些工具适配是很差劲的; 这点至少不如kimi和ds

  • Noah 06-12 13:19
    9

    本身模型迭代也没有想象中跨度那么高的其实,5.2跟5.3本身其实是一代,只不过5.3特调coding,所以coding能力确实比较好,纯coding来讲,5.3和5.4差距没有想的那么离谱,只有跟5.5的差距比较大,5.5确实跨越了一些以往coding的难题,今年国模能到5.5我觉得有点够呛,有希望但是感觉不太大,ds4当时都拖了快仨月才出

  • 岑夫子丹丘生-李白是个坑 06-12 13:21
    10

    25年初ds v3发布的时候,一度认为差距在6-8个月。但是目前个人认为现在差距是10-18个月。坏消息是这个差距是肉眼可见的在拉大。

  • OneDayLeft 06-12 13:21
    11

    我是觉得, 国内模型本身我觉得其实落后也没那么大, 基本都指令遵循, 意图推断, 工具使用都是过关的, 但最大的问题是工具适配吧.


    也就是模型能力本身之外的一些东西, 不是所谓的skill系统, 提示词工程这么简单的, 而是综合系统设计和协同

  • 星空的光 06-12 13:29
    12

    我觉得6-12个月,国外硬件管饱 。我相信模型发展速度会暂缓,硬件解放后国模会慢慢追上来。系统设计哪些都是开源的,大家抄就行了。国内在应用上的创新一直是很厉害的,当然技术层面弱很多。

  • ziyuxingyuan 06-12 13:40
    13

    差距大概6个月左右。但是想想相当于sonnet4.6或者gpt5.2左右的水平其实已经很强了,完全够用了。

* 帖子来源Linux.do
返回