阿里的 tokenplan 真是一言难尽

gux928 2026-08-03 15:06 1

今天看到 tokenplan 新上了 DeepSeek v4 flash 0731 ,(我也不知道之前为什么下掉 Flash ),想试试看是不是划算,找了半天没找到模型消耗的对比


我也就是想找到大概用哪个模型模型便宜,是 v4 flash 还是优惠中的 qwen-3.8max preview


发了工单问客服,客服又把文档发了一遍


您好,Token Plan 采用统一 Credit 抵扣机制,覆盖不同模型、不同工具。系统会根据模型档位、上下文长度、输入/输出 token 数、是否使用 Harness 工具(如联网搜索、代码解释等)综合计算 Credit 消耗,因此不同类型的调用消耗差异较大。具体的用量以实际产生的 Credits 消耗量为准。


各位大佬有大概清楚的吗? 也不用多精确,看个大概就行。

最新回复 (26)
  • cskeleton 08-03 15:08
    1
    这种只能自己测一下吧,我正在试图测一下 qwen3.8-max 不带 preview 的用量如何。然后再来测 ds flash
  • sentinelK 08-03 15:11
    2
    阿里的 deepseek 限流非常严重,TPM 1.2M token
  • gux928 楼主 08-03 16:03
    3
    @cskeleton 就给个 opencode go 那种类似的对比也行,现在这样太黑盒了
  • lue828 08-03 16:51
    4
    我用 qwen-3.8max ,几个简单任务就用量 30%周额度,太夸张了
  • Foxkeh 08-03 16:58
    5
    周末才抢到的 lite 版本的 token plan, 用 glm-5.2,做个小型单体项目的代码分析,周限直接干到只剩 3%
  • helysan33 08-03 17:11
    6
    preview 下线了 没有 1 折 。这个额度 根本没法用了。
  • kekxv 08-03 17:23
    7
    之前 199 的团队,一天不到,全部用完了,一个月的额度
  • winning11k 08-03 17:31
    8
    @lue828 好像 GLM5.3 也快出了,再等等看
  • superrichman 08-03 17:33
    9
    copilot 也一样,现在都改成 credit 了,很抽象
  • shawnvan 08-03 17:34
    10
    @kekxv 哈哈哈,同一天,还好是他们赠送的,简直傻眼
  • hit9 08-03 17:39
    11
    preview 版本还比较耐蹬.. 但是现在正式版 qwen3.8max 额度就用的很快了...
  • helysan33 08-03 17:44
    12
    没有 preview ,没有 1 折。可以直接申请退款了
  • hidemyself 08-03 17:51
    13
    太快太快了,我两次请求把我 5 小时限额干没了
  • gux928 楼主 08-03 18:00
    14
    @helysan33 #6 preview 已经下了吗? 那真是不敢用了
  • gux928 楼主 08-03 18:01
    15
    @winning11k #8 就算有 5.3 也会是用起来飞快吧
  • winning11k 08-03 18:27
    16
    @gux928 大概率,看友商的压力了,你看 DS 出个 coding plan 估计就要降价要不增量
  • Yserver 08-03 18:46
    17
    @sentinelK #2 阿里正价的 ds 感觉限流还好 但是缓存命中率很低 而且缓存命中很贵

    阿里的限流不是很透明 有一个 Request rate increased too quickly 根本无法判断
  • brsyrockss 08-03 20:00
    18
    @gux928 这就是他们的目的,主要是竞争不够激烈,大家现在都不够卖的.就跟手机套餐的 QCI 一样,国内外大的运营商套餐里都不写 QCI,反倒是网络运营商都会写的清清楚楚的 ,因为小公司没有什么吸引人的卖点,只能把这些潜规则拿出来告诉你,就跟把心都掏出来告诉你:"看我没有骗你,没有套路你,我是真良心啊",但是大的运营商就不在乎了,反正怎么搞都赚钱,无所吊味.
  • lino68 08-03 20:33
    19
    token plan 出了 qwen3.8-max preview 之后,我立即就从 3.7max 切到这个使用了,目前感觉明显 preview 耐用,因为官方说 10 倍用量,或者说是 1 折。不过使用的时候经常出现 qwen3.8-max preview unavailable 的情况
  • leyfung 08-03 21:02
    20
    我试了 qwen3.8max ,消耗感觉是 dsv4f 的好几倍,五小时额度很快就没了,qwen-3.8max preview 有活动肯定是最便宜的
  • yarawen 08-03 21:56
    21
    你们真是,有好东西不早说
  • xmsl 08-04 09:53
    22
    5 小时限额不够用啊。。。一会就没了
  • catinsides 08-04 09:59
    23
    千万别买!我刚买的 Lite ,试着让 qwen3.8max 分析个目录结构,活都没干完,5 小时额度没了,7 天额度干 30% 多。何况我的项目还是超小型项目,这能用来干啥?
  • Kakus 08-04 10:22
    24
    token plan 里面的 qwen3.8-max 的 credits 消耗确实非常快,几个小任务就把 5 小时额度用完了,gml5.2 也差不多。
    但是 DeepSeek v4 flash 0731 消耗速度还可以接受,单个任务消耗低于 10%额度,速度和质量也可以接受。

    其实可以考虑买 135 抵 全模型通用抵扣 300 元 套餐,45 折 算下来 deepseek-v4-flash-0731 输入单价 0.45 / M, 输出单价 0.9 / M, 有缓存折扣,但不清楚具体价格。
  • feiyu001 08-04 11:46
    25
    @catinsides lite 太快,我跑个疯狂的小鸟 都没跑完 5 小时就完了
  • yangxj96 08-04 11:53
    26
    阿里的目前如果用他提供的 dp4flash 消耗还好, 上周用他自己的 qwen3.8 max prview, 2 天花光一周额度, 还是在是一折优惠的情况下花光的.
* 帖子来源V2EX
返回