最新的 deepseek-v4-flash 正式版真的有这么强吗?

jxl594 2026-07-31 15:25 1

deepseek-v4-flash 正式版卡在 7 月最后一天发布,看评测数据很强,受不了智谱这种涨价方式,梁圣才是中国 AI 真正的希望

最新回复 (94)
  • xqk111 07-31 15:26
    1
    看跑分,超过了 grok4.5 ,感觉很强啊
  • xqk111 07-31 15:27
    2
    也超过了 glm5.2 ,有点牛
  • seakingii 07-31 15:29
    3
    希望是真的.DS FLASH 才是真的用的起的模型
  • xiaomushen 07-31 15:30
    4
    是很强,但是 V 站上大部分,不都是非 Fable5 或 5.6Sol 不用的高级用户么?
    DS V4 Flash 强不强,和他们似乎关系不大吧
  • ghostman 07-31 15:32
    5
    刚试用了下非常快
  • jxl594 楼主 07-31 15:34
    6
    关键是,v4-flash 版本如果能达到 GLM5.2 的水平,那真是太便宜了,GLM5.2 和 KIMI3 可以暂时拜拜了
  • jokcylou 07-31 15:38
    7
    glm 股价 200 可期
  • TomatoCLI 07-31 15:39
    8
    @jxl594 不仅便宜,而且还快
  • jxl594 楼主 07-31 15:42
    9
    @TomatoCLI 对的,不过便宜比快更重要,后面看看小米 MIMO 能不能追上来。
    真是又期待,又害怕。能力强又便宜,那就能用得起了,但是,另一方面,程序员的含金量 K 线,感觉还在下降通道中。
  • soulflysimple123 07-31 15:45
    10
    deepseek v4 pro 如果有 gpt 5.5 的水平,友商就难了
  • yiranw09 07-31 15:45
    11
    刚才试了一下,感觉超过了之前的 dsv4pro ,关键似乎还降级了
  • xiaomushen 07-31 15:45
    12
    503 了,
  • vitozyl 07-31 15:47
    13
    能用+够用才是正途. 智谱被称为中国的 Anthropic, 但也不能照搬全学呀
  • Faintlike 07-31 15:53
    14
    280b 秒了 740b ,肥鲸,现在的你,强的可怕...
  • penll 07-31 15:55
    15
    非常牛逼,超过 GLM5.2
  • cjhyy 07-31 15:55
    16
    虽然 cc 和 codex 拉满了 但是自己总要搞点活啊 目前的感觉来看。模型的快速跃升期要到瓶颈了 60 分与 80 的差别可能不会那么大了 速度和成本应该下一个方向。之前自己充了 300 块 deepseek 用 pro 太慢了。flash 反而用的还顺手一点 做一些简单的活又便宜又快
  • NealLason 07-31 15:59
    17
    体验下来很超预期
  • jxl594 楼主 07-31 16:00
    18
    @cjhyy 确实,真正使用的时候,速度很重要,Qwen3.8-Max-Preview 运行一半就卡死在那里,GLM5.2 之前也慢的要死,正常工作几乎不可用。
  • niceshell 07-31 16:02
    19
    @xiaomushen 不是这么说 真的用起来的时候 选最好的能节省时间
  • jxl594 楼主 07-31 16:03
    20
    要是梁圣再开源一个好用的 harness 项目,那真是功德圆满了
  • hanbaoji 07-31 16:05
    21
    真的假的?价格有变化吗?
  • StudyFung 07-31 16:05
    22
    试试就知道了
  • FredWang 07-31 16:11
    23
    @jxl594 不是说即将发布么? deepseek harness
  • utodea 07-31 16:11
    24
    体验下来增强了不少,https://github.com/usewhale/whale
  • xiaomushen 07-31 16:14
    25
    @niceshell 程序员的时间值钱么?
  • menfrexu 07-31 16:22
    26
    已经将 flash 作为主力模型了。牛逼 https://github.com/Menfre01/waveloom
  • Dream4U 07-31 16:30
    27
    @xiaomushen #4 主要是 20X Codex 用不完,天天重置,三个人分摊,一个人两三百,真是最便宜的套餐了。
    DS 看 API 价格是便宜,但如果用 Pro ,一天几十上百很正常。
  • WashFreshFresh 07-31 16:36
    28
    不知道公司买的聚合服务什么时候更新
  • jxl594 楼主 07-31 16:38
    29
    @WashFreshFresh 不知道 opencode go 上的 v4-flash 是不是官网直连的,那就更划算了
  • stdout 07-31 16:40
    30
    1kw token 不到 5 毛,用的越久 cache 命中越高,跟不要钱似的。
  • jxl594 楼主 07-31 16:43
    31
    @stdout 目前跑了 3.4kw token ,价格 1.5 ¥,去 TM 的 coding planning ,用多少花多少才是真香
  • yiranw09 07-31 16:48
    32
    opencode go 可以用正式版本了
    但是需要在后台开启“启用部署在中国的模型”
  • stdout 07-31 16:50
    33
    @jxl594 国内唯一个能用的很爽的,能和 grok4.5 流畅,解决大部分问题不用反复问,我就非常满足了。deepseek falsh 已经满足我的需求了。我下个月把 grok 切换过来。
  • xiaomushen 07-31 16:52
    34
    @Dream4U 这倒是..个人订阅根本用不完,奥圣动不动就重置。。
  • listen2wind 07-31 16:52
    35
    昨天站里还是梁÷,今天就成梁圣了
  • stdout 07-31 16:53
    36
    我做空了 minimax 和智谱,赚多少就充多少给 deepseek
  • 526457385 07-31 16:54
    37
    我问一下各位啊,哪个模型出来跑分不是吊打其他所有模型,你们看看你们现在正在用的什么模型
  • snowman231 07-31 17:00
    38
    特别,特别,特别的快。写起代码来很舒服。
  • Aaron0705 07-31 17:02
    39
    试过了,很强,长任务方面比之前强了很多
  • damila 07-31 17:03
    40
    我基本不看跑分,但是刚才体验了一下,效果远超个人预期,而且很快,这波是梁圣
  • EngelEyes 07-31 17:10
    41
    反正比隔壁"性价比首选""对标美系旗舰"强。
  • congminhcap246 07-31 17:15
    42
    刚好 deepseek 更新了,对比下同个 prompt 各个模型生成的效果。

    你是一个精通计算机图形学和前端性能优化的专家。请编写一个单文件( HTML + CSS + JavaScript ),实现一个惊艳的“3D 粒子动态涡流( Vortex )”视觉特效,支持移动端,支持动画暂停和重置另外带上我的署名。

    严格限制条件:
    1. 不允许使用任何第三方库(如 Three.js, Pixi.js, Canvas-nest 等),只能使用原生 HTML5 Canvas 2D Context 。
    2. 粒子必须在真正的 3D 空间内运动(拥有 X, Y, Z 坐标),并通过数学公式(透视投影 Perspective Projection )实时计算并映射到 2D 屏幕上,表现出近大远小的透视效果。
    3. 必须实现 3D 旋转矩阵,让粒子流能够随着鼠标的移动,围绕 X 轴和 Y 轴进行平滑的 3D 视角旋转。
    4. 必须处理深度排序( Depth Sorting/Z-indexing ):计算粒子的 Z 轴距离,远处的粒子先绘制,近处的粒子后绘制,并配合不同的透明度和模糊度,制造真实的纵深感。
    5. 包含色彩渐变或极光效果,粒子数量不低于 2000 个,必须使用 requestAnimationFrame 保证 60fps 的流畅度,代码要优雅、模块化,并写清核心数学公式的注释。

    https://llm.sweetui.com/opus5.html
    https://llm.sweetui.com/kimi3.html
    https://llm.sweetui.com/gpt5.6.html
    https://llm.sweetui.com/grok4.5.html
    https://llm.sweetui.com/deepseek.html
  • maoqiucute 07-31 17:15
    43
    试了一下 确实又快又强
  • jko123 07-31 17:17
    44
    不知道 DeepSeek v4 pro 正式版能不能达到 GPT5.6 SOL 水平,能达到那就棒了
  • albin504 07-31 17:19
    45
    @congminhcap246 不懂题目是啥意思。但是看效果,deepseek 生成的更科幻、也更美观。
    gpt 和 kimi 生成的是啥玩意儿,至少有点糊
  • albin504 07-31 17:20
    46
    利好腾讯啊。 腾讯的 AI 产品能用好低价、开源的模型,真是福音
  • jxl594 楼主 07-31 17:24
    47
    @congminhcap246 相对而言,还是 deepseek 效果差一点,不过总体要求基本都达到了吧
  • BuffDog 07-31 17:26
    48
    我试了下相当不错,比 v4 pro 预览版强不少
  • kera0a 07-31 17:38
    49
    flash 都这忘了,pro 不得起飞咯
  • mgcnrx11 07-31 17:43
    50
    它自己公布的跑分下,有行小字:对于公开基准测试集中的 Code Agent 任务,正式版 DeepSeek-V4-Flash 使用 DeepSeek Harness (即将发布)的极简模式作为框架进行测试,并使用 max 档位,topp=0.95 ,temperature=1.0;

    不能看跑分就认为是模型进步了的,harness 对跑分的影响也非常大的
  • min 07-31 17:48
    51
    那 pro 出来了的话还得了?
  • catazshadow 07-31 18:13
    52
    @albin504 deepseek 连右上角的 fps 都是瞎写的
  • pinylin 07-31 20:52
    53
    我觉得智商不行, 非常简单的任务都错了。5.6 Luna-max 和 qwen3.7-max 都正常
  • lovecodey 07-31 21:17
    54
    @congminhcap246 k3 不应该是这个实力,我用第三方部署试的
    https://cuddly-chocolate-0yslyari.edgeone.dev/
  • ZeroDu 07-31 21:40
    55
    deepseek ,glm 现在就差多模态。glm 这一涨价都赶上 gpt 了
  • raphx 07-31 21:58
    56
    不支持多模态......
  • ota 07-31 22:05
    57
    @xiaomushen 可以作为 subagent 啊。和非富即贵的大模型不冲突。
  • xiaomushen 07-31 22:27
    58
    @ota 苹果用户的高贵怎么可以被国产安卓模型玷污?( CodeX 用户只能算是半苹果半安卓)
  • xiaomushen 07-31 23:05
    59
    苹果用户只用苹果模型( Fable5 ),绝对不会碰安卓模型。当然,苹果用户也许失业后送外卖,但部妨碍他们的高贵
  • NNNNzs 07-31 23:11
    60
    @vitozyl #13 a 畜 z 畜 首尾呼应
  • oIIo 08-01 00:03
    61
    在 Codex 里高强度用了 4 个小时,审核 3d 即时战略游戏战斗模块/寻路模块代码(找 bug 、优化项)以及某功能模块实现,更复杂的问题还没试过。感觉 gpt-5.6 terra 没多大区别,关键是干完这些才花了不到 4 块钱....
  • DinnyXu 08-01 01:10
    62
    @congminhcap246 我看了一圈觉得 opus5 很好看,是一个旋风一样,gpt5.6 是不是没用对啊,也太撇了吧,我可是刚买的 plus 啊,这效果不应该啊,另外 ds 的很好看,想宇宙一样
  • cue 08-01 03:46
    63
    重仓算力和光通信的同学又有福了,好日子还在后面呢🫠🫠
  • dododook 08-01 03:56
    64
    @listen2wind #35 第一次听呢,梁目前口碑还行的吧
  • gdw1986 08-01 05:45
    65
    让你们说得热血沸腾的,在考虑要不要直接换 DeepSeek 了,也不用折腾 codex 了
  • kuaner 08-01 06:11
    66
    精准狙击 GLM 涨价,显得无比滑稽
  • lzylzylzy130 08-01 08:48
    67
    给后面的 pro 做铺垫来的吧
  • kirbyzhu 08-01 08:49
    68
    @congminhcap246 如果 ds 编程能力能达到 opus4.8 的水平 那就无敌了
  • germain 08-01 09:20
    69
    我做了一个实操的 code review 和纠错实验,我让 Deepseek v4 flash (OpenCode)去 review 我一个在 GPT 5.6 Sol Ultra 做的项目,Deepseek v4 flash 找出了 41 个问题并实施了修改。

    然后我再用 GPT 5.6 Sol Ultra 去 review ds v4 flash 做的修改,sol 最终报 ds 准确找出了 38 个问题,3 个问题 sol 认为它自己写的没错并 revert 了 ds 的修改。在 38 个问题里,ds 正确修复了 26 个,其余 12 个修复不完整或不安全,随后 sol 完成了 12 个剩余问题的修复。

    这个能力已经远远超出了我对 ds v4 flash 的能力的心理预期,再加上土一样的价格。。。
  • HinamiAoi 08-01 09:51
    70
    试了下不错,主要快。
    拿 AI 干活的就知道速度其实蛮重要的。
    做的某个功能 ios 代码 -> 安卓代码迁移,大概 2000 行代码,5 个模块,基本符合预期吧
  • mingtdlb 08-01 10:16
    71
    @jxl594 #18 Qwen3.8-Max-Preview 慢的不行。。

    @congminhcap246 #42 ds 跑题了吗? k3 什么垃圾,opus5 可以
  • MacsedProtoss 08-01 10:19
    72
    @stdout 我看我一个月 gpt 40B 也就是说用 v4 flash 也要 2000 还是 codex 大善人啊
  • Xi 08-01 10:32
    73
    智谱抢不到、kimi 套餐涨价,一个个耍猴,还得是看梁圣,不知道 deepseek v4 pro 还能提升多少。
  • icanfork 08-01 10:38
    74
    利好程序员,其他家也会降价的
  • seven777 08-01 10:41
    75
    腾讯家的 buddy 里的 DeepSeek-v4-flash 早就有了啊,是同一个玩意儿吗? buddy 里的也随着转"正式版"了?
  • Busy 08-01 10:57
    76
    还行,日常使用看什么任务
  • Timzzzzz 08-01 11:16
    77
    @seven777
    那个是 4 月的,731 是后训练完刚发布的
  • bigl9999 08-01 11:25
    78
    下周 ai 应用又要走一波吗
  • cskeleton 08-01 11:31
    79
    @Xi #73 反了吧,现在是 zai 涨价,kimi 买不到
  • jackerbauer 08-01 12:57
    80
    相当的不错啊,基本指哪打哪,一次性通过
  • Binwalker 08-01 13:10
    81
    什么时候原生支持多模态就好了
  • wzw 08-01 13:18
    82
    @Dream4U 用 sub2api 共享, 然后用到 codex/cursor 等?
  • Dream4U 08-01 13:33
    83
    @wzw #75 是的
  • wzw 08-01 13:48
    84
    @Dream4U #83 cursor 你用吗? 套进去用, 效果如何
  • yuhuij 08-01 13:51
    85
    @congminhcap246 opus5 和 DeepSeek 的不错
  • Dream4U 08-01 14:01
    86
    @wzw #77 没用,几乎只用 Codex
  • paranoiagu 08-01 14:46
    87
    试了一下,真的可以。。绝对可以当主力模型用。
  • seven777 08-01 14:55
    88
    @Timzzzzz #77 版本号都没改,用户应该认为"是一致的"吧?
  • plmsuper8 08-01 15:43
    89
    @MacsedProtoss 但是缓存命中只收 1/50 ,这样算命中率高那就是 6 美元了。而且 deepseek 的缓存机制也比较优秀。
  • Rorysky 08-01 17:56
    90
    @congminhcap246 其实这种 角色式的 prompt 已经过时了
  • Nasdaq 08-01 18:00
    91
    快的起飞(搭配 pi ),但是受限于上下文长度,还是不如 fable5 (是不是要求太高了),哈哈哈。
  • vicazuruhu97 08-01 18:04
    92
    试了一下,狗掉不是,和原来差不多,一度以为我用到了旧的,但是我买的是官方的,里面也就两模型,也不知道咋才能用上正品,改代码会错,说话也没啥逻辑,审核也不行。
  • across 08-01 18:26
    93
    发现支持 codex ,换 codex + v4 flash 试了下。
    刚好需要做两个知识星球群组帖子拉取到本地做 obisidan 知识库的,让 v4 flash 做方案+执行,全程 3 块···· 可以了,我没意见,以后估计我是 codex + qoder 的组合了。
  • wangxiaoer 08-01 18:29
    94
    不是很理解,这种大模型的评分,差那么一分两分有区别吗?
* 帖子来源V2EX
返回