所有模型语言能力都在倒退?

Eeevan 2026-06-09 16:53 1

我之前知道Opus4.8、4.7和4.6、4.5的风格完全不一样,反正都是拿来coding,没什么区别,但今天问个问题但没想到回复风格给我看到很恶心^-^,就让4.6输出了一版,这个语言风格是不是差距太大了点,今天终于有了实感,感觉最近所有的模型都在押宝agentic和coding,导致语言能力大幅倒退。点名GPT、Claude、Deepseek,唯一语言能力进步的竟然是GLM5.1。


不想再被“稳稳接住”“一句话总结”“堵住”“按住”“先…否则后面…”“逐条拆解”“赌”折磨了,看多了,我都怀疑我认不认识中文了,真的能这样用吗。


最好笑的是最近看B站,大量的稿子都有这些黑话和语癖,真的很出戏…

就像看小说出现“投石”和“指尖泛白”一样,让我顿时没兴趣了 ^-^



展开查看图片



Opus4.8
Opus4.6


不否认模型能力的提高,但是模型最终还是和人交互,语言能力越来越拉,越来越不受重视,目前的模型各种奇怪表述看的人恼火。

最新回复 (19)
  • Trzeth 06-09 17:04
    2

    不会呀,我反而会更喜欢一些4.8的回复。首先把问题定义清楚,再把影响比较大的条款逐条拆开,最后说具体影响了哪些对象。这样逻辑链路感觉会清晰很多。 如果喜欢4.6的回复模板,可能直接把框架塞给4.8让他填空就行了?

  • KnownRabbit 06-09 17:10
    3

    用英语跟大模型对话吧。有两个好处。


    一是模型能力真的会提升。思维方式决定行动方式,这不是说着玩的。近几年模型厂商都不做多语言能力测评了,但之前有这类测评的时候,英语都是做为满分基线,评估其他语言距离英语有多少。


    反过来讲,就是大模型用其他语言的通用能力必然弱于英语。


    二是,非英语母语者看不出来英语的语言能力问题,我们看大模型说中文,就像看老外说中文一样,必然能挑出问题。但英语就不会,因为本身咱英语就不好 ^-^ ,理解会失真。大模型说 You are absolutely right 咱也不会觉得他语言能力差

  • zerohh 06-09 17:12
    4

    确实我不喜欢黑话,opus4.8有没有进步不知道。蒸馏了gpt是知道的。

    opus4.6属于A/最顶级,最好用,最符合我要求的模型了。


    为啥gpt5后会有那么多黑话,哪里来的这些黑话 ^-^

  • 无敌暴龙战士 06-09 17:12
    5

    这是真的,大编程模型是这样的。感觉开始吃自己产的ai废料有点多了。gpt5系列讲话都没有人样,我不会编程,所以我只用他们来写东西。感觉特别强,opus4.6体感其他两个模型没有办法比.gpt现在只当搜索模型了.deepseek4系列也没有3系列好用.

  • 利陆都2253 06-09 17:16
    6

    确实应该用英文和 LLM 对话。


    中文训练语料质量低且污染严重,已经有文献指出了中文语料被污染了,你会发现 L 站上很多人说 4.8 不说人话基本都是中文问答,但是很少有用英文问答说模型不说人话。


    高质量中文语料在互联网很少,举例来说,B 站、抖音、小红书这些 APP 中的高质量中文语料都是不公开的,LLM 根本没机会获取它们,没有高质量中文语料,那就只能靠蒸馏开源模型,结果就是 4.8 那糟糕的中文回答结果。


    当然,某些中文语料更丰富的领域用中文更好,比如传统医学之类。

  • jcc 06-09 17:18
    7

    用了英语,有时候不注意的话,跑偏了你都反应不过来。。。降智也看不出来,被忽悠也不容易发现


    非母语的交互,会影响效率影响智商


    这波语言能力的下降,是因为各家旗舰模型的参数量都开始降了,和语言数据之类的没关系


    gpt-4.5是OpenAI参数量的巅峰,opus-4.6是A社参数量的巅峰,后面的旗舰模型,参数量都是开始下降的

  • Jeff Dean 06-09 17:18
    8

    Gemini Aegntic能力一直弱,语言能力好像没咋退化

  • ninaya 06-09 17:19
    9

    感觉拿来训练的中文数据集都是知乎的语料,因为知乎那里的回答几乎都是这种格式的 ^-^

  • Hifumi Mizuhara 06-09 17:20
    10

    其实日语这边也有感觉,虽然没有中文严重,但是4.8的语言不如4.6平易近人了。

  • Eeevan 楼主 06-09 17:23
    11

    不是母语,阅读速度和理解能力会被严重影响,尤其是非自己专业的领域,使用英文都不一定能看懂回复,完全是捡了芝麻丢了西瓜 ^-^

  • Eeevan 楼主 06-09 17:26
    12

    Gemini的语癖一直都是自己独特的味道,像是蒸最少的

  • 方生无归 06-09 17:29
    13

    最自然的还得是Sydney小姐(GPT4)

  • Xun030 06-09 17:29
    14

    非母语对效率的影响太大了,就算能看懂,但是编程时大模型返回英文输出就很难受,灵感会断的感觉

  • KnownRabbit 06-09 17:32
    15

    是的,所以只能训练自己 ^-^ 猛猛读英语,猛猛写英语,毕竟人也是可以被训练的……

  • Eeevan 楼主 06-09 17:35
    16

    不同意。为什么要因为模型缺点而折磨自己,让自己自适应模型的不足。这本来就是模型自身的缺陷,并且是可以被改善的,提出来是想让模型更好而非苛责。


    我可以使用英文和模型对话,但是我希望出发点是基于我自身想提高英文能力,而非因为模型缺陷被逼无奈去使用。这两者的性质是不同的。

  • wdf202 06-09 17:43
    17

    我在过去一个月给各个LLM设置,对人说中文,对Ai的文档/语料说英文,发现大幅降低了我review文档的效率,并影响了代码质量。现在已经要求任何文档都输出中文。 ^-^

  • KnownRabbit 06-09 17:43
    18

    因为用各种手段提升智能体性能,本就是 harness engineering 的一部分。


    英语好用,我就用英语,用英语对话只是个手段,也只是手段之一。我的产品用户也不会英语,所以我会让它用英语思考,做中间一系列步骤,输出还是中文


    就像摩托车比自行车快,我就会去骑摩托车,因为抱怨自行车的缺点解决不了我任何问题……


    但没驾照,会被有驾照的人淘汰。

  • 叶秋 06-09 17:44
    19

    英文也是一堆语癖,都一样的,是模型的固有缺陷

  • dw 06-09 17:49
    20

    我也觉得这几个月gpt,claude都降智了,因为我不可能变得聪明,所以模型降智是显而易见的。。。

* 帖子来源Linux.do
返回