GLM 5.2 思考过程中的“让 me“是何意味?

阿囧啊囧 2026-06-16 09:44 1

最新回复 (12)
  • 超级无敌小飞舞 06-16 09:45
    1

    (帖子已被作者删除)

  • OptionalFullName 06-16 09:45
    2

    RL 插入的强制延长思考过程的 token,可以看 DeepSeek R1 Zero 的论文。楼上那种外行发言笑笑就好。


  • Anglyao 06-16 09:46
    3

    估计蒸馏了某英文模型,而且他似乎有补救一点,所以me 的前面没加空格?

  • owen666 06-16 09:46
    4

    之前Claude不就这样嘛,let我/让me xxxx

  • 泠音 06-16 09:47
    5

    Claude 喜欢Let 我,GLM喜欢让 me​^-^

  • 白芸汐 06-16 09:47
    6

    let 我 tell 你 why


    这是强行延长了思考时间的后训练,没学到DeepSeek的多步推理说是


    你看见的循环推理也有一部分这个原因 ^-^

  • Firefox 06-16 09:52
    7

    坏了我突然想到一个鬼畜视频




    let me do it for you

  • gongwendong 06-16 10:12
    8

    这基本上是目前所有agent的都存在的问题,英文内核+翻译外壳。

    英文作为事实上所有模型的推理/planing/tool call的标准格式,而且agent开发的内置提示词也是英文,所以在系统的提示词没有加声明“所有输出必须使用纯中文,不用中英文混杂”情况下,没有本地化润色,没做语言一致性标准化处理,只是最后交互是用户的语言,对于"让me"这种表达方式其实就是直观反应了这种模式下发生的一种印象。


    生活中,出国留学回来的孩子,你会看到人家都会时不时的说几句ok,sorry啥的,所以对于模型土生土长是英文环境的模型来说,就更合情合理了。


    现在虽然很多中国人参与AI领域的研发,但是中文一直是底层缺席者,英语就是已经作为了事实的标准格式了,所以中文英文的用户交互体验上越来越模糊化了。英文已是事实上的机器标准语,你说应该没有哪个科学家工程师会去挑战这套游戏规则吧?


    现在主流的LLM英文语料也比较多,好像还有写专门把中文语料翻译层英文语料进行模型训练的呢,

    之前看过一个有趣的项目,有人为了省token,把描述写成文言文,看着挺新鲜的,不过其实本质上也只是做了一层翻译外壳,我就一直好奇,这种机制是不是就可能让我们国人在生产力方面就会少那么一些呢?就类似每个用windows开发的中国内地人要去解决乱码的问题一样呢?

    这是不是会让使用中文的人/团队,在 AI 生产力上"天然少那么一些"??挺好奇的。

  • OptionalFullName 06-16 10:14
    9

    看看 qwen 的 tokenizer 再看看 openai 的呢?思而不学则殆

  • Gray Paris 06-16 10:20
    10

    虽然你字多,但是楼上的延长思考的后训练说法似乎更可信一些 ^-^

  • ThomasHancock 06-16 12:14
    11

    这个和claude输出韩文有一曲同工之妙

  • jcc 06-16 12:18
    12

    正常的,别看思维链就行了,思维链是模型自己用的,不是给你看的

* 帖子来源Linux.do
返回