DeepSeek太夸张了

lz 2026-06-20 21:36 1

19亿的Tokens,缓存命中18.8亿,我的天哪,什么神仙缓存,一共15块钱 ^-^

大佬们,正常使用没插件,纯官方api,今天打算再充钱的时候发现缓存高的吓人

最新更新,楼主眼瞎把1.9亿看成了19亿,对不起对不起对不起,哈哈哈哈,真尴尬啊

最新回复 (40)
  • AiLiBoss 06-20 21:36
    1

    pro这么夸张吗

  • coldsword 06-20 21:37
    2

    官方api的好处,比三方的缓存率都高

  • 大鲨鱼 06-20 21:37
    3

    毕竟它自研的 kv 缓存技术也是亮点之一

  • Zelk 06-20 21:37
    4

    这么猛吗,为啥我用没这么高,是不是有提高命中率的插件 ^-^

  • ElonMuskX 06-20 21:37
    5

    都是啥问题,写代码不同的项目背景也能命中吗

  • aiocy 06-20 21:37
    6

    1.9吧

  • wq287627997 06-20 21:37
    7

    你干啥来着

  • 江郎才尽 06-20 21:38
    8

    牛逼了 这能这么高

  • weyy 06-20 21:38
    9

    快分享一下,用了什么方法 ^-^

  • lz 楼主 06-20 21:38
    10

    @AiLiBoss #1 @coldsword #2 @大鲨鱼 #3 @Zelk #4 啥也没用就官方api ^-^

  • jtsang 06-20 21:39
    11

    @lz #10 用的啥调用方式啊

  • Monkeypox 06-20 21:39
    12

    deepseek的缓存命中率断档第一啊

  • lz 楼主 06-20 21:40
    13

    @ElonMuskX #5 @weyy #9 就正常使用,今天打算点钱,顺便看一下Token,才发现缓存这么吓人

  • Determinant 06-20 21:42
    14

    火星救援了,v4刚出来就这样

    90%都算低的,一般都是95朝上

  • fucker 06-20 21:43
    15

    那可以试下我签名了,对比下

  • wuwufei 06-20 21:43
    16

    @lz #0 直接官方API 直接调用吗? 用设置什么或者 装什么插件吗

  • a8266365 06-20 21:44
    17

    一共花了多少钱

  • Yserver 06-20 21:44
    18

    我cc都能99.45% ^-^

  • kiya 06-20 21:47
    19

    @coldsword #2 是不是比opencode的也没有官方缓存厉害呀?

  • lz 楼主 06-20 21:48
    20

    @wuwufei #16 纯官方api,那些奇奇怪怪的我没弄

  • wuwufei 06-20 21:48
    21

    @lz #20 那牛逼哦 ^-^

  • lz 楼主 06-20 21:49
    22

    @a8266365 #17 19.1亿Token,一共花了15.66准确的金额,非常夸张

  • Huse 06-20 21:49
    23

    缓存是啥

  • Newton 06-20 21:49
    24

    Deepseek确实很划算,token很便宜啊。

    我在家里的一些应用,都放弃本地AMD395上跑的Qwen3.6-35B, 直接用Deepseek了

  • coldsword 06-20 21:52
    25

    @kiya #19 我感觉比opencode的厉害不少

  • lz 楼主 06-20 21:54
    26

    @Newton #24 对啊,而且DeepSeek天生没甲,我在网上看到我路由器被人家爆出个漏洞,我直接把文章丢个它,然后成功把科学上网塞路由器里,爆破和扫漏洞它什么都能干,而且老便宜了。 ^-^

  • a8266365 06-20 22:13
    27

    @lz #22 确实离谱 哥们

  • nullptr-t 06-20 22:18
    28

    ds的缓存存的久,不像claude一会就没又得重算,感觉后者是故意的

  • 一只荷兰猪 06-20 22:20
    29

    别管好不好用,就说便不便宜

  • Yukimeepo 06-20 22:20
    30

    这个缓存是指你之前用过的吗。我刮削书怎么一点没命中,50本书花了我2块

  • 小导演i 06-20 22:23
    31

    为啥这么高 ^-^

  • emdel 06-20 22:24
    32

    @Newton #24 科学上网塞路由器里,爆破和扫漏洞


    这也能干?一般不是会说啥违法不让干嘛🤔

  • yunechan 06-20 22:26
    33

    吓死了,我以为19亿15块,看了眼1.9亿

  • Uevrmw 06-20 22:26
    34

    cpa轮询用codex逆向了个软件花了23.3Mtoken缓存有90%命中率

  • bloom8262 06-20 22:27
    35

    问了一下gemini。deepseek 断档级别的领先。


    具体原因可以拆解为以下几个核心维度:



    1. 独创的硬盘级缓存技术(Context Caching on Disk)

      与很多西方大模型厂商(如 Anthropic、OpenAI)早期将 KV Cache 主要寄希望于高昂的内存(RAM)或显存不同,DeepSeek 采用了硬盘级的 KV Cache 缓存技术。

      • 超长生命周期: 大部分厂商的缓存由于占用显存/内存资源,通常在几分钟到一小时内就会被擦除(例如 Anthropic 默认缓存 5 分钟)。而 DeepSeek 将其持久化到了硬盘上,缓存生命周期长达数小时甚至数天。这使得即便用户冷启动或低频访问,也能轻松命中缓存。

    2. 极其聪明的“多级分段”与自动探测机制

      DeepSeek 的缓存匹配不是死板的“全凭运气”,它的后台有一套精密的固化与切片规则:

      • 固定 Token 间隔切片: 针对极长的输入或长文本输出,系统会在固定的 Token 间隔处自动切块(Carve out)。这样可以避免一整段长文本因为后面有一点点变动,导致前面长达几万字的内容全部无法缓存。

      • 公共前缀自动探测: 如果你连续发送两次请求,第一轮是 A + B,第二轮是 A + C。虽然第二轮因为不完全匹配 A + B 会导致 Cache Miss,但 DeepSeek 的系统会立刻在后台把公共前缀 A 固化为一个独立的缓存单元。当第三轮 A + D 进来时,A 就能 100% 命中。

    3. 多轮对话与 Agent 场景的天然契合

      在长对话、Code AI(如 Cline、Claude Code、OpenCode)以及 Agent(智能体)工作流中,前置的 System Prompt(系统提示词)、Tool Schema(工具定义)以及前序的历史对话是完全不变的,只有最新的用户指令在变。

      • DeepSeek 会在请求边界自动持久化。在多轮对话中,除了当前轮次新输入的几个 Token,之前几万字的上下文全部直接从缓存读取。

    4. 极致的价格倒逼生态(极低的缓存读取成本)

      DeepSeek 在定价策略上极其激进,其缓存命中后的输入价格比未命中便宜了将近 80%(例如 V3/R1 模型的缓存命中价格低至每百万 Token 几美分)。

      • 倒逼开发者优化提示词: 这种巨大的利益驱动,促使全球开发者在编写代码时,疯狂卷“缓存友好型”的提示词结构——即**“静态前缀在前(System/RAG文档/工具),动态尾部在后(时间戳/用户问题)”**。生态和模型的双向奔赴,进一步拉高了实际生产中的整体缓存命中率。


  • lz 楼主 06-20 22:29
    36

    @yunechan #33 卧槽,真尴尬,我好像看花眼啦 哈哈哈哈^-^

  • lz 楼主 06-20 22:29
    37

    @Yukimeepo #30 应该是吧,那几天都在玩一个项目

  • tof 06-20 22:47
    38

    @bloom8262 #35 缓存这个算法也是🐂🐂

  • aiocy 06-20 22:48
    39

    缓存多了,v4pro确实值,我之前3.1亿token的v4f已经15块了

  • mzne 06-20 22:51
    40

    我为什么还是觉得不便宜,一天10几块的一个月下来除去假期可能不用1/4的生活费都要没了

* 帖子来源NodeSeek
返回