Deepseek V4.1 Flash 真实体验

Leon6868 2026-09-15 11:04 1

使劲蹬了一天也就 20rmb ,agent 能力与代码能力大幅提高,多模态调试闭环完全能用


梁圣你回来了✋😩🤚

最新回复 (69)
  • tool2dx 09-15 11:08
    1
    我用 DSH,给一张图片来绘制一个场景,结果雷霆大思考输出了一堆错误,是不是用法不对.
  • Lemonyi 09-15 11:11
    2
    我用 V4.1-flash 和 glm5.3-flash 对比了下,满分 100 分的话,glm 是 90 分,V4.1 是 80 分吧,差距很小,就只是某个方面有些差距,但是 V4.1 是闲暇时段还有周六日才是 glm 消耗的一半,正常工作日周一到周五白天消耗跟 glm 是一样的,我现在公司是 996 的,周一到周五白天用 glm ,晚上和周六用 v4.1
  • BreakTheBank 09-15 11:12
    3
    3 小时用了 30 块。不敢用了,开了 opencode go
  • JoJoWuBeHumble 09-15 11:15
    4
    @Lemonyi 是在各种的平台上测的吗?我感觉 deepseek 在不在 dsh 上面差距还是很大的
  • JoJoWuBeHumble 09-15 11:15
    5
    @tool2dx 我倒是完全没有用它多模态的一块。不太相信 dp 的多模态
  • vfs 09-15 11:16
    6
    @BreakTheBank 能把人卡死。。。不会再续费了
  • Ossi 09-15 11:24
    7
    身边反馈比 glm5.3-flash 强不少
  • awesomePower 09-15 11:28
    8
    还是比 GLM-5.3 差不少,用 v4.1 做一个需求要来回改好几次
  • bbbblue 09-15 11:43
    9
    我这边前几天有几个完整的管理后台页面 我把需求文档给了 图也给了 很快就做完了
    虽然有一些 bug 比如多选框不能取消全部 选择筛选项的过程中会清空之前的结果之类的 但感觉完成度挺不错了 关键是好快啊
  • liudon 09-15 11:43
    10
    @vfs 晚上会快很多 😂
  • foryou2023 09-15 11:45
    11
    能力还行满足需求,就是变得有点啰嗦了,很容易探索要求之外的事情。
  • vampuke 09-15 11:46
    12
    @Lemonyi
    随便找了个会话算了一下
    未缓存输入 180,148 tok 缓存读取 49,288,704 tok 输出 239,651 tok
    4.1flash 是 0.18 * 2 + 50 * 0.04 + 0.24 * 8 = 4.28(高峰期价格)
    glm flash 是 0.18 * 0.8 + 50 * 0.23 + 0.24 * 2.8 = 12.316
  • l0s7r 09-15 11:54
    13
    有道德吗
  • vfs 09-15 12:03
    14
    @liudon 你说的晚上是 0 点之后? 我最近经常晚上九十点用, 就卡的我, 忍不住自己动手写了, 用它的 AI 简直是浪费生命。 我的月度还有三天就结束了,但是 token 采用了 60%, 不是我不想用,是它实在太卡了
  • xironwater 09-15 12:14
    15
    自己用着前端进步明显,算是把 ds 的短板补上了不少,性价比还是可以的
  • calcoe 09-15 12:19
    16
    在一众低参数模型中已经很不错了,而且有梁文谷能狠狠蹬
  • Leon6868 楼主 09-15 12:35
    17
    @vfs #6 270+tps 很卡吗
  • twofox 09-15 12:41
    18
    我也是一天可以用 20 多。然后算了一下,这么下来一个月大概需要 400 左右,然后准备跟同事拼一个 codex pro 了
  • KOMA1NIUJUNSHENG 09-15 13:16
    19
    为什么 ds 一开思考模式,感觉能跑一万年
  • NakanoAzure 09-15 13:29
    20
    这个头像好熟悉,好像推上看过🤔
  • liudon 09-15 13:32
    21
    @vfs 我白天晚上都在用,白天感觉慢一些,晚上 10 点后感觉会快一些,没遇到卡的情况呢
  • MIUIOS 09-15 13:37
    22
    @l0s7r 这个是新的多模态底座,道德方面强化了不少
  • MIUIOS 09-15 13:38
    23
    @tool2dx 他超级容易雷霆大思考,你做这种的相反不能开高思考,因为这种是确定性的,我前阵子让他绘制了太阳系,开最低思考绘制出来的贼无敌。
  • sampeng 09-15 13:50
    24
    一天 20 ,不算你加班就是 600 ,周末用就是 800-1000 。请问这么算还梁圣吗?再计算一天做了多少个需求,你就明白了。可能都不如 glm…
  • zhao69270 09-15 13:51
    25
    目前感觉还是 glm5.3flash 好用,已经抛弃 DeepSeek 了
  • Kale 09-15 14:38
    26
    @Leon6868 Opencode 确实卡的。
  • vfs 09-15 14:53
    27
    @liudon @Leon6868 啊, 难道就我自己卡..... 你们挂代理了?
  • Leon6868 楼主 09-15 15:08
    28
    @vfs #27 我用的是官方,稳定 270+tps
  • hoor 09-15 15:16
    29
    @BreakTheBank 我也是开了 opencode go ,单备用
  • Nu1lXX 09-15 15:24
    30
    使劲蹬了一天也就 20rmb ?? 20$吧
  • Cloud9527 09-15 15:26
    31
    个人体感 4.1flash 更好用,主要是速度快。5.3flash 还是慢一些。功能这两个都能实现。
  • PopRain 09-15 15:26
    32
    请问一般做 coding 用 GLM 5.3 FLASH 还是 DS 4.1 FALSH ?
  • qianyeyixi 09-15 15:34
    33
    用 4.1flash 做了项目,没法新群友口中的问题。我觉得编程能力要比 5.3 强,速度也快尤其是大型任务尤其明显。conding plan 的任务 任务链比较长的情况双方有 10 分钟的差距。https://github.com/wang-yi-bit64/dsh-desktop 改项目有 glm-5.3flash, ds-4-flash, ds-4.1flash, gemini-3.7flash 共同完成
  • qianyeyixi 09-15 15:42
    34
    @PopRain 推荐 4.1flash 速度快
  • hellodudu86 09-15 15:45
    35
    每天高强度用,v4.1 出之前我的主力就是 glm5.3flash ,对比起来 v4.1 还是强一些的,现在价格和速度也更占优势,glm 停用了。
  • hellodudu86 09-15 15:46
    36
    不过我之前的 glm 不是在 zcode 上用,也是在 dsh 上用。
  • bao3 09-15 15:57
    37
    烧钱很快,同样的推理,质量只比 gemini-3.8 好一点。所以我都几乎不用它,估计只能做简单的题目。
  • amoSjiang 09-15 16:02
    38
    “使劲蹬了一天” 得说多少 token ,多少钱
    你登一天不如我登一个小时,这话白说
  • qianyeyixi 09-15 16:04
    39
    消费金额:¥41.73 CNY
    API 请求次数: 3,156
    Tokens: 716,734,730. 大概在 30 块钱的时候项目已经完成了,因为这几个模型做架构不太行,让 chatgpt 聊天的做了架构和中长期规划 ,剩下的全都是在调整方向
  • wktline 09-15 16:09
    40
    glm5.3-flash 这不是弱智吗?
  • vfs 09-15 16:13
    41
    @Leon6868 哦哦哦, 误会了,我也用过官方的 API ,我才说 OpenCode Go 辣鸡的不行,不建议充值,太慢了
  • poxiaohy 09-15 16:15
    42
    体感比 GLM 5.3-flash 略强,但是 Zcode + GLM 配合挺完善了,各种统计和交互不比 codex 差,一天 20 元为何不用智谱的 plan 呢?
  • jonsmith 09-15 16:22
    43
    flash 模型是未来趋势? GLM-5.3-flash 和 deepseek-v4.1-flash 性价比都非常高,智力够用,速度快。目前我是用 deepseek 更多,因为它的速度最快。
  • wanglz111 09-15 16:29
    44
    三个号 workbuddy + ds v4.1 flash = free
    我这几天狠狠整理了我的测试文档,干脏活太好用了。
    gpt5.6sol 30-40t/s
    ds v4.1 flash 300t/s
    整理文档,整理测试用例,整理需求报告,ds 体感太好了,又快又准
    workbuddy 可以帮着生成 html 的汇报,流程图什么画的极好,帮助理解需求太方便了,真神了
  • Rorysky 09-15 16:30
    45
    一天 20 ,一个月不就 600 了么?
  • pluszone 09-15 16:37
    46
    5.3flash 虽然有点智障,但看在每周送 3Etoken 的从操作上,我给他拉到 DS 同等高度。
  • breezy23 09-15 16:45
    47
    我在 pi 里面用 v4.1flash high ,目前还没发现它解决不了的问题
  • zzboat0422 09-15 17:00
    48
    我在 opencode 和 zcode 中同时都接入了 dsv4.1f 和 glm5.3f 。交叉干活,然后用 codex 中的 gpt-5.6-sol review 这两个模型的工作结果。

    交叉对比下来,无论是 opencode 中还是 zcode 中,dsv4.1f 均强于 glm5.3f ,被 gpt5.6sol review 出来的错误更少,而且速度更快。
  • dong706 09-15 17:01
    49
    @pluszone 每周送 3E 是什么活动?
  • pluszone 09-15 17:08
    50
    @dong706 每周末送 3 亿 5.3 flash token, Zcode 客户端直接领取。 周五晚到周一早之间生效。
  • Leon6868 楼主 09-15 17:17
    51
    @Nu1lXX #30 你太小看粱圣的前缀缓存了
  • KJH 09-15 17:22
    52
    听你们一说,刚刚让他给我改 4 个 bug

    哐哐一顿输出,消费 5 元,我一验证,bug 解决数 0 。。。
  • chemzqm 09-15 17:24
    53
    还是整个套餐吧,直接 API 还是有点小贵
  • yekern 09-15 17:28
    54
    公司给啥用啥. 我们现在是直接对接的 API. 我用的 omp 解决问题还可以 有自动学习 踩过的坑很少会踩第二次 和上面差不多 几乎没有不能解决的 在我的开发场景下
  • iorilu 09-15 17:28
    55
    我最近试了 dsf4.1 也感觉不错

    主要在 dsh 里面干活基本不会停

    也不会问来问去

    反正我最晚搞了个我认为可能有点折腾的活, 没想到一次性 2 小时干完了, 超出我预期

    所以我现在把 dsf4.1 提升为完全可用的级别, 那自然那个便宜用哪个

    如果舍不得包 gpt pro , 按量使用 dsf 是比较划算得
  • yekern 09-15 17:37
    56
    用量也不是很大
  • macscsbf 09-15 17:37
    57
    太贵了
  • Leon6868 楼主 09-15 17:51
    58
    @KJH #52 那是好事啊,说明你的工作比较复杂,没法被 AI 取代
  • Desiree 09-15 18:33
    59
    @sampeng 一个月 600 还不如 gpt
  • IUserName 09-15 19:17
    60
    我一直搞不懂,这么多模型 pro flash preview plus ultra 到底哪个更好。
  • Lemonyi 09-15 19:23
    61
    @JoJoWuBeHumble 在 WorkBuddy 里面测的,然后现在在做一个比较复杂的 crm 系统
  • Lemonyi 09-15 19:26
    62
    @vampuke 我是结合自己项目干活使用情况综合分析的
  • eben 09-15 19:44
    63
    我写了 6 个小 PHP 功能,花了 16 元
  • Leon6868 楼主 09-15 20:00
    64
    @sampeng #24 还真是,一天 20 的话还真不如买 gpt pro ,openai 至少是真的顶级模型
  • KJH 09-15 21:32
    65
    @Leon6868 #58 高情商
  • iorilu 09-15 21:43
    66
    @Leon6868 也没那么简单

    不可能每天都是高强度工作的

    按量付费还是有一定优势
  • RexKang 09-15 21:58
    67
    高峰期在 zcode 里面用 opencode go 的 ds-v4.1-flash ,发现又节约能力又强(对比 glm-5.3-flash )。
  • resist 09-15 22:16
    68
    我感觉现在 DeepSeek 有点流口水了,笨还乱搞
  • lozzow 09-16 02:18
    69
    我用的是 ollama cloud 的订阅,我感觉 DS4.1 flash 很猛啊。相比降智版本的 astra 猛多了,我这个 100 多万行的 c++酷酷的改,完全没问题
* 帖子来源V2EX
返回