Qwen3.8-Flash 光速降价 比glm-5.3-flash便宜1毛

fengchris 2026-08-27 15:44 1

笑死,知道要被斩杀,赶紧降价了,昨天还是1/3,今天就变成0.8/2.7。


不过智谱目前限时五折,还是更低,就是性能可能不如ox了



最新回复 (19)
  • 羽于羊 08-27 15:47
    1

    阿里的这个显式缓存创建是何意味,不会他家的缓存还需要手动创建吧

  • kiki 08-27 15:49
    2

    缓存存储,emmm不会是要收2次前吧?存储一次,命中一次。

  • sheepman 08-27 15:50
    3

    有试过的吗?这俩模型具体效果怎么样

  • fengchris 楼主 08-27 15:53
    4


    [显式缓存]:需要**主动开启**的缓存模式。需要主动为指定内容创建缓存,以在有效期(5分钟)内实现确定性命中。除了输入 Token 计费,用于创建缓存的 Token 通常按输入 Token 标准单价的 125% 计费,后续命中通常仅需支付 10% 的费用

    [隐式缓存]:此为自动模式,无需额外配置,且无法关闭,适合追求便捷的通用场景。系统会**自动识别**请求内容的**公共前缀**并进行缓存,但缓存**命中率不确定**。对命中缓存的部分,通常按输入 Token 标准单价的 20% 计费

    反正是个坑

  • huachuan12 08-27 15:55
    5

    (帖子已被作者删除)

  • ceshi01Adx 08-27 15:56
    6

    按参数规模本来就不如glm5.3-flash啊。。原本定价就不合理..阿里常规都是极其离谱的定价,包括之前那个27b也是相对来说非常高

  • fengchris 楼主 08-27 16:00
    7

    阿里这个定价就针对C端 企业用户价格是可谈

  • danielR 08-27 16:00
    8

    到底能力强不强呢?总之似乎 QWEN 系列大家风评都不咋地,但都喜欢自己本地部署起来用,然后 A\追着砍,很矛盾.

  • 羽于羊 08-27 16:00
    9

    还是有自动缓存的,只是并不能算很便宜

  • ceshi01Adx 08-27 16:04
    10

    之前那个27b是很强的,应该是同尺寸最强了,而且27b也是你可以勉强在单卡4090上跑的模型,只是显存不足多subagent的话容易过早压缩,能力确实很不错..

  • 深海的章鱼 08-27 16:05
    11

    qwen3.5-flash是0.2元/M……可惜回不去了

  • whyyzs 08-27 16:07
    12

    这是api的价格吗,还是token plan的?

  • 赤足行进 08-27 16:11
    13

    应该类似oai和a/的那个写入缓存

  • HeriX 08-27 16:15
    14

    无论是总参数和激活参数

    都比glm5.3flash要小

    结果价格还差不多(更别提后者限时半价)

  • Tom Cat 08-27 16:17
    15

    3.8flash是什么,是用3.8 27b后调的吗。

    之前3.5 flash就是用的已经开了的小模型调的

  • astrostar 08-27 16:20
    16

    3.8flash是昨天才发的新架构模型,跟之前的都没太大关系了

  • blacksein 08-27 16:21
    17

    他家分显式 显式要自己加参数/锚点开启的 显式创建+读取都要收费 好处是更精准(比如你业务的最前面的一大串 system prompt可以稳定命中)

    隐式他家不收创建 只收读取


    各家不一样的 阿里和gemini比较像


    openai在5.6之前是隐式的 只有读取费用 到5.6有显式和隐式之分 但是他的隐式也收创建的费用。。。

  • kiki 08-27 16:31
    18

    这种好像之前听说过,可以把code map和code source塞进去,然后去做任务这样好处,code source这种长上下文便宜。

  • ishadows 08-27 16:33
    19

    openai隐式缓存会收缓存创建费用?api吗?

* 帖子来源Linux.do
返回