Deepseek v4.1 flash 配 DSH这缓存是真离谱啊,8亿缓存才一百万输出、忙活大半天真的只有快。

快热的鸭皮 2026-09-20 15:37 1



这还是凌晨跑的,这要是高峰期价格就毫无性价比了,梁子你在干嘛!

最新回复 (19)
  • He110 09-20 15:39
    1

    ds 的 Token 输出很怪,总感觉换 ds 后 Token 用量飞涨,之前日均 100M 左右 K3 ,换了模型后拉到 300M+

  • crazycrazyshui 09-20 15:40
    2

    是的,v4.1虽然快,但是一是有些时候陷入死循环,二是实际上token消耗量提升太大了

  • 快热的鸭皮 楼主 09-20 15:40
    3

    感觉就是忙了一天啥也没干,改了半天效果还不好。 ^-^

  • 白学森 09-20 15:40
    4

    不要使用max思考,会变得不幸 ^-^

  • 路飞s 09-20 15:42
    5

    8亿token,2500请求 平均每个请求30多w,这个上下文有点猛,其实仔细算下来干的活其实不多

  • szz 09-20 15:42
    6

    佬,在哪里调整思考强度?现在执行任务基本思考30分钟左右才干活。

  • W1nge 09-20 15:42
    7

    最讨厌这种输出多思考多的模型了

    一直给我堆屎山 ^-^

  • 快热的鸭皮 楼主 09-20 15:42
    8

    刚好我用的就是max模式,大半夜不想动,第一次用deepseek。之前用WorkBuddy感觉效果很差,别人说WorkBuddy智商低、要用官网的,用了官网的感觉也差不了多少啊 ^-^。

  • He110 09-20 15:42
    9

    参数量还是很有参考意义的,参数量太少处理复杂任务确实容易钻牛角尖,感觉泛化要差一些

  • 蓝樱 09-20 15:43
    10

    确实是看着非常厉害,但实际上消耗非常多

  • 白学森 09-20 15:43
    11

    dsh的话模型那边可以选吧,选high就行

  • 时牧 09-20 15:43
    12

    用high档就行了,官方都推荐用这个

    max只会雷霆大思考

  • 快热的鸭皮 楼主 09-20 15:43
    13





    右下角

  • jairooo 09-20 15:43
    14

    基本只能用high非思考 做点自动化的工作

  • lka 09-20 15:44
    15

    所以真不知道,社区里不停的有人吹他缓存命中率怎么高,意义到底再哪里。循环废话当然缓存命中率高,最终要看是否解决问题,花了多少世界,花了多少钱。其他都扯淡。总体来说ds的消耗体感上就是大的多。

  • 白学森 09-20 15:44
    16

    WorkBuddy的harness做的比较垃圾,建议是WorkBuddy领积分,然后去下一个codebuddy cli(claude code 马化腾风味版)来用,积分是共享的

  • 快热的鸭皮 楼主 09-20 15:45
    17

    适合做简单、需要速度快的东西,有一说一输出速度真是快啊,token消耗速度也快 ^-^

  • 白学森 09-20 15:45
    18

    说实话感觉是酱汁了,,刚出来的时候非常强)

    算上订阅价格感觉每任务成本其实是和GLM 5.3F持平的。它快得很啊

  • szz 09-20 15:45
    19

    佬,你用的是官key吗,中转站没有思考强度选择。

* 帖子来源Linux.do
返回