模型们什么时候说人话

Swifty 2026-08-31 23:24 1

随着各家把重心放在coding/agentic工作上,越来越多的SOTA模型不说人话 ^-^

之前以为是海外模型的训练数据和语料问题,最早在GPT 5.4和opus 4.7时期大量出现,随后向国模扩散,当时觉得DeepSeek V4还属于比较有人味、中文水平较好的模型。

但是近期观察到,同一个模型在不同环境下的口癖显著不同,例如K3在kimi work的chat模式下中文流畅自然,遣词造句也符合正常人类说话风格,即使在kimi code里进行调研和撰写报告也可以保持写作能力,但一旦进行了一定程度的代码工作后,无论是输出文本还是写md文档,用不了多久就会充斥某些味道无比浓重的词汇,包括但不限于“门,杠杆,判负,裁决”……




之前用opus的时候感觉是一些英文名词直接替换成中文(典型的“烟测”)导致的,现在发现即使K3这种已经证明有较好中文能力的大参数量模型,在实际执行了大量agent调用后就会丧失说话能力,开始进行大量压缩的黑话输出,各位佬有头绪吗 ^-^

最新回复 (2)
  • 席乐 08-31 23:28
    1

    我觉得那就是正常的语言吧,不能算黑话。你如果要求不用专业的词汇,要用大白话,你可以直接跟大模型要求呀,写在 Agent.md 里: 不要使用专业术语,请使用大学一年级学生能听得懂的大白话跟我沟通。


    条件覆盖,权重,契约, 门禁, 冒烟测试, 如果你来说给同事听,你怎么把它说成大白话?

  • Swifty 楼主 08-31 23:57
    2

    这些词汇都可以接受,但是整体上文字有时候会以一种高度压缩的形式比如极短的词汇和短语组合呈现,虽然看得懂是什么但是很别扭

* 帖子来源Linux.do
返回