阿里官方出 qwen3.8-27b 的 API 了,但是这价格真的合理吗

李大普 2026-08-22 00:44 1

输入/缓存/输出 分别是 3/0.6/12



这更是比高峰时段的 v4 flash 还贵 ^-^

最新回复 (10)
  • Ruby 08-22 00:44
    1

    我在16g显存的显卡上自部署能跑160K上下文了,也勉强凑合用用了

  • leisure 08-22 00:45
    2

    这么贵,还不如用DS的,效果更好点

  • 咪叭 08-22 00:46
    3

    阿里是这样的,之前的qwen3.5 3.6也是这样,习惯了

  • code 08-22 00:48
    4

    听一些佬友说稠密模型激活参数多,推理成本高

  • 李大普 楼主 08-22 00:49
    5

    还真是,你说完我去看了一眼,3.6 27b版,甚至是3¥/18¥,还没缓存^-^

  • cyclopentadiene 08-22 00:51
    6

    一方面设高价推大家做自部署能吸引用户群,另一方面如果不部署要用API,那就多收点也不亏 ^-^ 该租卡整uncensored了

  • 海獭 08-22 00:56
    7

    阿里云的模型主打tob,tog,贵点很正常

  • igg8 08-22 01:03
    8

    大佬,怎么部署,能不能给一个大概的思路

  • Ruby 08-22 01:05
    9

    unsloth那个ud-q3的13g量化,然后走llama.cpp的turboquant分支,k开tb4 v开tb3.上下文131072 显存占用15.4g 共用显存0.2g 都开tb3就可以160k了

  • GloryDuck 08-22 01:09
    10

    国外自部署的也差不多这个价,不知道基于什么定价的


    看了一圈基本输入都要 $0.4/M

* 帖子来源Linux.do
返回