一言难尽的DeepSeek 4.1 flash

dongkid 2026-10-06 00:35 1

不知道该说它神还是区。。


神就神在它好像真能完成任务,甚至有时候完成的还非常好,很惊喜的感觉。


但是剩下就一言难尽了,用起来感觉很难受。


同一个任务消耗的token几乎是glm5.3f的2-4倍,上下文也是,经常遇到打到500-600k窗口然后注意力下降占用更多上下文的恶性循环。


不说人话,不约束的情况下经常造一些生词,遇到过回答的时候什么乱翻译函数名、莫名奇妙的成语和比喻,读起来很费劲。


反复做一些不知道有没有用的验证:

让我来验证一下…

再验证一下…

我想起来…

让我再交叉验证一下…


让它回答一个问题它去吧相关的不相关的文件全部读了一遍,一边读还一边interesting… hmm… oh…

不知道在干嘛…

最新回复 (13)
  • windsing 10-06 00:35
    1楼

    有点怀念以前的v4了。。。。

  • YAARB55646 10-06 00:38
    2楼

    同感,我用4.1flash总感觉它喜欢发散思维,自顾自去验证和测试

  • windsing 10-06 00:40
    3楼

    有部署但很慢。之前用了一个某个学术组织部署的,不过现在也下架了

  • Zmmfly 10-06 00:40
    4楼

    真实体验是大工程里token猛猛耗,结果效果并不好,这还是有astra当leader的情况,要是独自干,感觉堪忧

  • dongkid 楼主 10-06 00:41
    5楼

    对,表现出来就是很不自信,看他的思考过程明明已经得出了答案,快要结束了,下一秒又开始读文件确认,然后就是hmm… interesting… ,硬生生把过程又翻了一倍才给回复 ^-^

  • sg8011 10-06 00:41
    6楼

    是的,然后在agents.md里写了不要这样发散,但是还是被华丽的无视了

  • coofee 10-06 00:41
    7楼

    我这里整好反过来,ds4.1f非常好,但是glm5.3f就非常的拉,而且还过度消耗token。我用的官方的glm5.3f

  • dongkid 楼主 10-06 00:43
    8楼

    我后面也用agents.md约束了,就是要写的具体一点。

  • sg8011 10-06 00:45
    9楼

    感觉没什么用,我按论坛里的一个帖子说的写了9条规则,好家伙,一开始还遵守,后面几乎一条不落的违反了

  • anin 10-06 00:58
    10楼

    qoder ds4.1 high我感觉还可以 最起码速度非常快 搞一些基础脚本操作和小程序挺好的

  • 🦐虾佬 10-06 00:59
    11楼

    其实我跟你同感 我自己是思考拉满 慢慢跑的,接入codex 加上codex-x海鸥破甲 做一下反代项目挺好用的 有一次测cline模型免费真身,glm一直弄错,ds完美算出

  • 杰特 10-06 01:00
    12楼

    感觉好像过度特化,反而让他在一些能力上有下降,难道是后训练过头了吗(?

  • maximo 10-06 02:13
    13楼

    降智了好像 腾讯王琰有测试 今天用we need思维链居然不能帮我扫系统温度 提醒了两次 他还幻觉了mac系统是win 我查过prompt 系统信息都是注入了的

* 帖子来源Linux.do
返回