deepseek-v4.1-flash 好像得了ADHD

Syzema 2026-09-27 22:53 1

如题,社区里好像几乎没人谈这个问题,0731 的问题还不是那么明显,但最近深度用了 v4.1,感觉越来越严重了。之前对 deepseek-v4-pro-0813 的评价仍旧可以套用到 v4.1-flash 上——一个患有ADHD的模型,工作记忆很低,然后注意力又很差。


我不是职业开发者,目前主要的工作方式是先在 omp 里先用 gpt-6-astra 规划,然后 deepseek-v4.1-flash 执行。


虽然之前一直有佬友说把需求写清楚了,ds就能执行得很好,但我发现即使需求写得特别清楚,deepseek仍旧喜欢在某个小细节上开始雷霆大思考,然后一直反复的试错和验证,写个文档都能在没人要求的语义等价性上卡几个小时,然后每次都只改一点点 ,偷吃我的token,真的是吃白饭的大肥鱼!^-^


补充: 全程思考强度用的 high


这几天被ds折腾得已经彻底没招了,求佬友们帮忙支个招 ^-^

最新回复 (19)
  • crazycrazyshui 09-27 22:54
    1楼

    模型特性,只能把max改成high跑

  • Syzema 楼主 09-27 22:55
    2楼

    就是全程用的high ^-^

  • Blackwood416 09-27 22:55
    3楼

    我只能说别用max,思考越多幻觉越多

  • inliver 09-27 22:56
    4楼

    好像没有特别好的办法,本身模型的注意力比较有限的感觉,容易跑偏,可以试试 agentteams 模式,让lead设置好goal之后,分配子进程来实现任务,lead则负责监督任务完成是否偏移要求等等

  • 空喵 09-27 22:56
    5楼

    选择high档位就够了

    另外可以agentmd或者skill约束一下大肥鱼

  • crazycrazyshui 09-27 22:57
    6楼

    那就没办法了,之前看人测评就说过flash的这个问题,很容易过度思考

  • jqtmviyu 09-27 22:58
    7楼

    遍历式思考, 只能用来实现已有方案.

  • wanmu 09-27 22:59
    8楼

    是这样的,真的注意力很低,极其马虎莽撞


    所以我昨天发的帖子中,说 ds 只适合做“完成”类任务,不适合做“完善”类任务

  • Syzema 楼主 09-27 23:00
    9楼

    之前有试过用 astra 开 omp 的 advisor 当监工,astra 喊了三四次 别干,跑偏了,v4.1-flash 都不听,真没招了 ^-^


    注意力差又头铁,总之就是嗯干

  • sonderz 09-27 23:01
    10楼

    确实dsv4.1f有这种感觉,就是感觉不太专注,说实话从干活的角度来讲我的体验上不如glm5.3f(虽然z/)

  • Aandy 09-27 23:02
    11楼

    Install the i-have-adhd skill/plugin from GitHub - ayghri/i-have-adhd: A skill to stop your coding agent from burying the answer. ADHD-friendly output. · GitHub, refer to the repo’s AGENTS.md for instructions. 试试这个

  • 哈基米我南北绿豆 09-27 23:03
    12楼

    别呀我之前就使用的dsh某个图形化团队的插件,哪个使用后开始至规划6个人,后面越来越多,越来越多,最终开了18个会话ds不停写代码不停报错,不停开新会话分配,使用的是标准PTC预设,ds还是有问题,说不上来,就是实际生成投入还是差一点 ^-^(叠甲 ^-^)

  • inliver 09-27 23:04
    13楼

    不应该吧,官方的agentteams设置了上限的历史总和是8个,我感觉官方那个还行,类似于逆向分析类任务非常合适,简单的开发也不错,创作模式

  • Syzema 楼主 09-27 23:05
    14楼

    佬,我装了,我的个人感受是和 shuorenhua 同类的 skill , 并没有改善编程能力,只是改善了可读性

  • Myallure 09-27 23:07
    15楼

    这个4.1就是区啦,评价为ds内部刷分已经刷到不在乎用户的实际体验了,我都不懂明明glm 5.3flash和qwen flash next甚至mimo的比他好太多,论坛里怎么那么多讨论ds的,难道就单纯因为便宜?

  • loyicnaup 09-27 23:07
    16楼

    在codex中更是直接放飞自我了,感觉跟思考深度相关性不是特别大,就是喜欢循环验证至成功和原地兜圈。而且这个过程会往临时文件夹疯狂写一次性代码,浪费token,也浪费内存。该打断的时候一定要打断,不然跟指尖陀螺一样停不下来。

  • hisen 09-27 23:07
    17楼

    我是用 agents.md 强制约束了,感觉效果不错,基本不会乱发散,但是超过 500K 还是会有些发散。

  • 我刘邦 09-27 23:07
    18楼

    gpt好像就是比较喜欢测试 我一般用claude规划 然后大任务的开发前告诉ai先开发代码不要测试 等全部开发完在测试 其实不止ds这样 claude gpt偶尔也会疯狂测试不干活

  • hisen 09-27 23:08
    19楼

    ds 没那么不堪,智商是真的在线的,只不过模型太容易乱思考了,发散,多动症。

* 帖子来源Linux.do
返回