Astra实际消耗其实是Sol的4-5倍

Canon 2026-09-05 22:53 1

20x的周限用完了,把这个周期内消耗的tokens拉出来对比了一下,在Astra和Sol的缓存命中率均为97%-98%的情况下(仅代表我的使用情况):

每减少1%周限,使用Sol约3800w-4200w tokens

每减少1%周限,使用Astra约800-900w tokens

而官方文档中,输入输出缓内等方面的credits,Astra仅为Sol的2.5倍,因此实际使用中,输入输出缓内比例差距不大的情况下,理应tokens数量差距也应为2.5倍,实际却差到了4-5倍

这种差异导致的结果是,原本纯Sol能用到2500刀的周限,纯Astra会仅为1600-1800刀左右。

最新回复 (17)
  • charliesxia 09-05 22:57
    1

    好的。谢谢佬的分享,可以估算成本,毕竟新模型还是挺贵的

  • 卡里姆•汗 09-05 22:57
    2

    感觉4倍多,我plus五限制,sol能用28m左右,gpt6就只能用6m左右

  • tt12580 09-05 22:59
    3

    缓存命中率均为97%-98%



    佬用的什么agent,缓存率这么高

  • 西门卤蛋 09-05 23:00
    4

    感觉astra的计费有点问题,我同样用400刀的额度,周限明显掉的比sol多

  • Canon 楼主 09-05 23:00
    5

    codex,这个的原因应该是我把上下文调高了,258k的时候缓存我记得大约是93%-94%,改到1m就变到97-98%了

  • Nebula1 09-05 23:01
    6

    相信tibo,不够用的时候会重置的^-^

  • tt12580 09-05 23:02
    7

    这样,我还是设置的250k左右,现在超过272不额外收费了嘛

  • Canon 楼主 09-05 23:04
    8

    对,官方现在好像明确表态超过272k不额外收费了。

    其实之前我记得好像在哪看见也是修复之后codex超了不额外收费,只是api超了会额外收费,这个就不确定了

  • 兔斯基不在家 09-05 23:06
    9

    这个是基于什么思考强度测出来的?

  • Canon 楼主 09-05 23:08
    10

    sol:90% max,10% ultra

    astra:100% max

    没有用过更低思考强度

  • gongchang 09-05 23:09
    11

    测试起来是这样。不知道tibo评论区是不是收到

  • yu1745 09-05 23:11
    12

    是5倍,因为纯用gpt6额度只有sol的一半,然后本身gpt6是sol的2.5倍计价,2*2.5=5

  • 114 09-05 23:13
    13

    大概率是复刻5.6sol,一开始出来秒天秒地^-^发现消耗异常^-^冲o​^-^^-^tibo宣称我们发现了一些问题已经修复并重置^-^实际上是降智了^-^智商一路下滑^-^下一轮模型发布,重复这个轮回

  • laohe 09-05 23:16
    14

    太贵了,完全用不起的感觉了。。。

  • jiah 09-05 23:18
    15

    我也感觉用的飞快,早上的时候新开20x订阅开着fast跑了个任务,发现就掉了5%,赶忙关了,20x都得省着点用

  • czm995212 09-05 23:26
    16

    不能光算token吧,还得算效率,如果gpt6 能一次搞定而5.6三次才能搞定,那么其实是一样的价钱,反正我用国产模型的时候经常反复改,但是用GPT sol或者A/时返工更少,算下来总花费其实差不多,关键是省时间

  • Neptune 09-05 23:28
    17

    opus5毒舌直接说这是openai为了制造Astra很便宜的假象手段 ^-^
    我用纯只用Astra和纯只用sol的两段时间调用,做了对比,实际消耗为3.93倍sol,误差允许内比较接近另一个贴算的1.8倍官方说法
    [image]
    [image]
    [image]


    一样的佬,我也是直接3.9倍计费了

* 帖子来源Linux.do
返回