GPT5.6引入缓存写入费用,1.25 倍计费

文文 2026-06-27 11:06 1

我看都没有人说啊,现在5.5不要缓存写入费用,5.6就要了,但是Terra大降价50% off,总体还是便宜了


GPT-5.6 的定价基于每百万代币,分为三种模型:Sol 的输入价格为 5 美元/输出价格为 30 美元;Terra 的输入价格为 2.50 美元/输出价格为 15 美元;Luna 的输入价格为 1 美元/输出价格为 6 美元。GPT-5.6 还引入了更可预测的提示缓存机制,包括支持显式缓存断点和 30 分钟的最低缓存有效期。对于 GPT-5.6 及更高版本的模型,缓存写入费用按模型未缓存输入费用的 1.25 倍计费,而缓存读取费用继续享受 90% 的缓存输入费用折扣。

来源:https://openai.com/index/previewing-gpt-5-6-sol/


为了准确对比 GPT-5.5 和 GPT-5.6 Terra 在 95% 缓存命中率下的实际费用,我们需要先明确两者的基础定价机制。


值得注意的是,从 GPT-5.6 开始,OpenAI 引入了“缓存写入 (Cache Write)”计费机制,即首次写入缓存的 Token 会按标准未缓存输入费用的 1.25 倍收取,而后续的缓存读取 (Cache Read) 依然享受 90% 的折扣。而以往的 GPT-5.5 在未命中缓存时并没有专门的“写入”溢价,仅按标准费率(1倍)计费。


1. 基础费率对比(每 100 万 Tokens)

































计费项 GPT-5.5 GPT-5.6 Terra
标准输入 (未缓存) $5.00 $2.50
未命中缓存 (初始写入) $5.00 (无溢价,按1倍计费) $3.125 (引入机制:按标准价的 1.25 倍)
命中缓存 (缓存读取) $0.50 (90% 折扣) $0.25 (90% 折扣)
输出 (Output) $30.00 $15.00

2. 在 95% 缓存命中率下的输入成本核算


假设我们总共向 API 发送了 1,000,000 (1M) 个输入 Tokens。


在 95% 的命中率下,意味着:




  • 5% 未命中(50,000 Tokens):作为新内容需要被写入缓存。




  • 95% 命中(950,000 Tokens):直接从缓存读取。




GPT-5.5 输入成本计算:




  • 未命中部分:50,000 Tokens × ($5.00 / 1,000,000) = $0.25




  • 命中部分:950,000 Tokens × ($0.50 / 1,000,000) = $0.475




  • 有效综合输入成本 = $0.25 + $0.475 = $0.725 / 1M Tokens




GPT-5.6 Terra 输入成本计算:




  • 未命中(缓存写入)部分:50,000 Tokens × ($3.125 / 1,000,000) = $0.15625




  • 命中(缓存读取)部分:950,000 Tokens × ($0.25 / 1,000,000) = $0.2375




  • 有效综合输入成本 = $0.15625 + $0.2375 = $0.39375 / 1M Tokens




3. 最终结论与对比




  1. 输入端大幅降低:在 95% 缓存命中的高复用场景下,GPT-5.6 Terra 的实际综合输入成本约为 $0.394,而 GPT-5.5 为 $0.725。Terra 整体输入费用下降了约 45.7%。




  2. 输出端完全腰斩:GPT-5.6 Terra 的输出费用($15.00)直接是 GPT-5.5($30.00)的一半(节省 50%)。




  3. 缓存写入机制的影响:尽管 GPT-5.6 增加了看似更高的 1.25 倍“缓存写入惩罚”(写入单价达到了 $3.125),但因为 Terra 的基础价格($2.50)本身就比 5.5 便宜了一半,所以哪怕是“被加价”的缓存写入,单价依然远低于 GPT-5.5 的普通输入价($5.00)。在高达 95% 的命中率下,这少量的初始写入成本几乎被极低的命中单价($0.25)完全稀释。




总的来说,GPT-5.6 Terra 完美兑现了官方“成本相较 5.5 降低 2 倍”的承诺,无论缓存命中率怎么变动,其总费用在各个维度均大幅低于 GPT-5.5。

最新回复 (19)
  • tty2 06-27 11:10
    1楼

    我看其他帖子说5.6有三个版本,有一个价格一半对标的5.5模型

  • JsonSong89 06-27 11:11
    2楼

    中北大杯超大杯

    GPT-5.6 Terra 是大杯(中间那个)

    其实还是得有个前提 就是 GPT-5.6 Terra 真的能力和 gpt5.5差不多

  • 我张三 06-27 11:13
    3楼

    5.5涨价,5.6再涨。o​^-^不当人

  • calendar 06-27 11:14
    4楼

    这么看 terra 不是降价了吗?对标的 gpt5.5

  • blacksein 06-27 11:15
    5楼

    不是吧 这是加了显式缓存 没说把隐式缓存去掉吧?

    gemini和qwen也都是两个都有呀

  • wjy 06-27 11:17
    6楼

    gpt-5.6 terra 实际表现能不能到GPT5.5存疑


    比如Claude Opus4.8 超越Opus4.6


    现在gpt-5.6也没有放出全部的benchmark,可能又是一次降本增效

  • 我张三 06-27 11:18
    7楼

    肯定用最强模型sol啊,用别的跟没升级一样。


    说的是它升级一次加价一次。你看人opus,版本一直变,价格从不变

  • Bliod 06-27 11:19
    8楼

    那不是因为opus一开始的定价就让他没有涨价空间了吗,而且这几代opus应该都在用性能换成本,再用一些别的法子补上去

  • 十元 06-27 11:21
    9楼

    坐等他发布了,gtp目前是国外相对稳定的了a畜坏事做尽

  • YaLei Li 06-27 11:21
    10楼

    这是全面向A/看齐啊,A/就是区分缓存创建和缓存读取的,倍率也是一致了

  • 我张三 06-27 11:21
    11楼

    没错啊,所以他一开始定价那么贵早就是A​^-^,

    现在OpenAI和opus看齐,变为O​^-^

  • blacksein 06-27 11:22
    12楼

    A\是直接没有隐式缓存的 他只有显式

    gemini是一开始只有显式 后来引入隐式

    openai是一开始只有隐式 现在引入了显式

  • eight silver 06-27 11:24
    13楼

    没看懂,佬你掰碎了讲讲 ^-^^-^ ^-^

  • coho 06-27 11:25
    14楼

    luna版本,对比5.5xhigh有多大差距啊?

  • key1 06-27 11:25
    15楼

    用不了啥用都没有,也没有啥用,想花钱的的地方都没有

  • 浅梦 06-27 11:25
    16楼

    现在怀疑的是terra到底能不能比过5.5,如果terra是5.5水平,sol是5.5pro水平,那绝对是质变,但恐怕未必如此

  • blacksein 06-27 11:26
    17楼

    显式是你要自己加cache控制的参数不然不读写缓存 可能还要加锚点 一般要额外收写缓存的费用


    隐式是你啥都不用做 厂商会自己判断写缓存读缓存 默认就会读写缓存 一般不额外收写缓存的费用

  • Nebula75 06-27 11:29
    18楼

    这个版本价格才是5.5的20%,性能可以直接对比吗?

  • c.skeleton 06-27 11:34
    19楼

    这个价格你应该去对标 GPT mini。

* 帖子来源Linux.do
返回