deepseek-v4-flash 大家有感觉出问题吗?

chongzi 2026-09-05 04:13 1

我线上产品调的是 deepseek ,平时做开发用 codex ,gpt 额度用完后会拿 deepseek 来顶


所以体感比较明显,大概是从昨天开始,线上突然开始出低级问题,开发用 codex 也是如此甚至一度达到不可用的程度

最新回复 (24)
  • greatghoul 09-05 07:51
    1
    我用 OpenCode 接入了 DeepSeek, 目前没感觉到什么问题。
  • jinsongzhaocn 09-05 10:06
    2
    长上下文堆积,涉及的问题越来越复杂吧,需要靠压缩和记忆体优化。flash 版本通常是缩小知识量的版本,所以解决有确定方案的问题,日常编码可以;但是探讨方案,解决未知问题,理解复杂逻辑,需要切换到 pro 版本,用更多的知识量更好。codex 至少 5T 的参数,dsv4flahs 不到 1T,知识量就差了一大截。
  • yeatmeret 09-05 12:25
    3
    我使用 cc-switch 上面接入官方的 dsv4flash ,感觉价格不便宜干活儿没那么好,我 ds 的话之前用 pro 多一点,ds 涨价感觉他就没什么竞争力了
  • airqj 09-05 12:43
    4
    现在花百来块钱买个 glm 丐版 code plan,glm 5.3 flash 免费蹬
    白天安排好工作让 zcode 晚上再跑。
    说实话这阵子找不到用 deepseek v4 flash 理由
  • airqj 09-05 12:44
    5
    @airqj 晚上十一点到次日九点免费蹬
  • yidinghe 09-05 14:20
    6
    大模型出问题都是概率性的,不出问题不表示没有降智,出问题不表示一定降智。
  • chongzi 楼主 09-05 14:28
    7
    @greatghoul 也是用的 v4-flash 吗?
  • chongzi 楼主 09-05 14:29
    8
    @jinsongzhaocn 我用的 skill 和文档较多,确实上下文会长,但是之前一直都顺利,就是从前天开始的,体感很明显
  • chongzi 楼主 09-05 14:30
    9
    @yeatmeret 太高贵了,pro 不敢用
  • chongzi 楼主 09-05 14:34
    10
    @airqj glm 丐版 code plan 大概有都少 token
  • chongzi 楼主 09-05 14:41
    11
    @yidinghe 难道大模型也得考虑高可用?一旦发现模型出问题,马上切换到别的模型
  • airqj 09-05 15:48
    12
    @chongzi #10 不是很多,但重点是 glm 5.3 flash 夜间免费蹬
    所以白天审核 + 制定任务计划 + 验证,然后晚上再跑就很爽了
  • greatghoul 09-05 17:16
    13
    @chongzi 嗯,是的,v4 flash. api 总结文章和 coding 都用的这个。
  • chemzqm 09-05 17:23
    14
    > 用的 skill 和文档较多
    大概率导致模型降智
  • everyx 09-05 17:40
    15
    同一会话,混用不同模型也会有问题
  • tuduweb 09-05 17:46
    16
    @airqj 晚上的运行速度咋样…之前送 3 亿 token 的时候,感觉跑的有点慢…
  • yidinghe 09-05 18:28
    17
    @chongzi 高可用不是你这么理解的,前几天一堆的大模型出故障,这个就是高可用的问题。我的意思是,不管什么大模型,都会有一些特定的场景,触发它的表现得降智的行为,这并不是模型本身被换了。
  • airqj 09-05 20:18
    18
    @tuduweb 不知道 反正一个大任务一觉起来差不多跑完了
  • jinsongzhaocn 09-05 23:06
    19
    DeepSWE v1.1 智能编程/软件工程智能体基准
    Kimi K3:67.5%
    GLM-5.3-Flash:63.4%
    Qwen3.8-Flash-Next:58.7%
    DeepSeek-V4-Flash-0731:54.4% (分数基本等于本地部署 Qwen3.8-Flash-Next Q4 量化版本)
  • ajaxfunction 09-05 23:12
    20
    光说前端代码,glm 明显强于 dp v4 flash 和 pro 。
  • wsbqdyhm 09-06 01:55
    21
    @airqj #4 我也买了那个 118 那个,能免费吗?是不是一定要 z code 才行。用 claude 接入不行?
  • chongzi 楼主 09-06 09:45
    22
    @wsbqdyhm 必须 zcode

    @airqj 我也买了,昨晚已经开蹬
  • chongzi 楼主 09-06 09:46
    23
    @yidinghe 就像服务器有健康检查,系统接入的多个大模型,是不是也可以专门做个降智检查,作为切换的触发条件
  • yidinghe 09-06 10:03
    24
    @chongzi 闭源大模型厂商会自动在简单任务时切换到较弱模型,但这是能保证任务完成的,而且你没办法阻止。大模型表现下降,主要是两个原因,一是环境恶劣,动不动就命令报错,就乱码,模型本来就走的磕磕碰碰;二是 U 型注意力机制问题,上下文一长就会忽略中间内容。刚学会用 AI 的程序员往往注意不到这两个问题。其实只要解决这两个问题,模型就会表现得很稳定。
* 帖子来源V2EX
返回