佬有感觉dsv4.1f鬼话(黑话)连篇的问题很严重么

紫野 2026-09-15 16:11 1

如题,最近高强度使用v4.1f后换回v4p了,无论是在回复邮件,写代码,写注释,说明文档等工作中,用词总是用一些黑话词,比如表达版本明明可以用version,偏要用用epoch。感觉就是蒸馏Claude蒸太多了,说话全是鬼话连篇,黑话连篇

最新回复 (6)
  • yu oimo 09-15 16:12
    1

    deepseek没有搞对齐叙事吧?我感觉把对齐的毛病也搞过来了

  • zzxzz12345 09-15 17:04
    2

    感觉越会说黑话的模型感觉越是过拟合,说人话的模型反而不过拟合,大概是因为其参数化记忆已经没有给他留下好好说话的空间,典型例子就是sol和muse spark1.3,最近ds flash和glm5.3 flash也有这个倾向

  • 翠花上酸菜 09-15 17:06
    3

    不说人话是趋势,搞代码过头了,RP能力大幅度下降


    过几个月说人话阵营只剩豆包和谷歌了

  • zzxzz12345 09-15 17:06
    4

    还有一个可能性是凡是后训练在奖励函数里尝试优化token效率的,都不可避免的让模型开始压缩表达造成了说黑话的结果

  • Kami958 09-16 00:12
    5

    是的,非常严重,我用它来写方案设计和架构文档,头很大,和用minimaxM3有的一拼

  • 宙方 🥇👽🛡️ 09-16 00:15
    6

    确实

    Qwen3.8Flash 倒是挺灵动的

* 帖子来源Linux.do
返回