感觉DeepSeek-V4.1-Flash 快是快 干活对比 4pro 怎么样 没有深度体验过

苏白 2026-09-13 22:47 1

感觉DeepSeek-V4.1-Flash 快是快 干活对比 4pro 怎么样 没有深度体验过

最新回复 (5)
  • 彼岸又一城 09-13 23:09
    3

    我感觉 token 消耗特别快,动不动就 1 亿了,不知道是国模通病还是只有 deepseek 这样

  • imon 09-13 23:11
    4

    如果你开1M上下文,平均token/请求估计都能到30万~50万了,是开了272K上下文的3-5倍。加上响应速度快,token消耗速度快5-10倍很正常。

  • C5Y 09-13 23:12
    5

    随便写写,想到什么写什么吧。如果你说的干活指的是coding的话,我个人感觉是v4pro的上位替代,找bug的能力,工具调用的能力,智商,速度等都比v4pro好。官方一度要把v4pro下架的(实际上在app和网页里面已经把pro下架了),后续因为其他原因又发通知保留pro的api服务。


    而且它是多模态吧,我是做嵌入式开发的,平常会接触硬件原理图,有多模态之后就可以直接整理出来硬件连接关系,方便不少(之前都是丢给ai stduio的Gemini来识别的)。识图这点4pro原生就做不到,如果要外加mcp还是挺麻烦的。


    然后v4.1 flash的速度是快很多,一般有200-300 token每秒,基本上是秒出字,但是实际用下来发现开max的话思考链会比较长,tps比之前是高不少,但是完成任务的耗时并没有缩短特别多。建议日常开high比较好。在DSH里面的标准模式的表现是最好的。


    站里有人反馈4.1有时候思考会出现死循环的情况,但是我日常用没有遇到过。


    另外,Workbuddy/CodeBuddy 最近是有免费用v4.1的活动,但是有佬友反馈在这里面输出窗口被限制到只有64K了,导致模型智商低很多。而且速度也慢很多。如果要体验的话最好还是去官方渠道充个10块钱用。


    官方API额度消耗的是真的快,感觉跟中转的gpt5.6有的一拼了。。。高峰期消费不起,1亿token大概在10块钱左右(谷价价格减半),性价比不高。可以考虑看看command的go套餐或者goat套餐吧,go套餐最好是反代出来在dsh用,有人反馈在command自己的agent里面额度消耗会比较快,goat套餐就有api提供可以直接接出去用。这两个套餐前面额度比较多,过了活动时间会降,但是总的来说还是比官方api划算点。。

  • 彼岸又一城 09-13 23:17
    6

    确实是,如果降到 272k 的话体验会差很多吗?我用 codex 都是 272,用 zcode +ds 它默认是 1m,我没调

  • imon 09-13 23:20
    7

    暂时没有感觉,我习惯经常开新窗口,要触发几次压缩看看会不会变傻才知道。另外这个压缩各个harness做的不一样,增加了选择的困难。

* 帖子来源Linux.do
返回