用千问冷门视觉模型,有没有推荐的中转站?

JH-hhh 2026-08-05 19:08 1

要求是大公司,比如硅基流动,使用qwen3 vl 8b instruct和qwen3 embedding 4b,是拿来做mt photo的大模型智能识别

本地部署过,但是速度有点慢,vl大概100token/s,embedding大概950token/s

价格不能比硅基流动贵,硅基流动价格是

vl 输入0.5/m,输出2/m

embedding输入0.14/m

最新回复 (7)
  • riddlezzz-666 08-05 19:09
    1

    自己买个gpt20x的号,用luna就行了。

  • JH-hhh 楼主 08-05 19:10
    2

    @riddlezzz-666 #1 那没必要,就是为了省钱

  • riddlezzz-666 08-05 19:10
    3

    @JH-hhh #2 你不知道这个价格多低

  • tianmu 08-05 19:14
    4

    我感觉你说的这几个模型,自己本地部署都能跑吧

  • nullptr-t 08-05 19:21
    5

    qwen3 vl 8b直接用qwen3.5 9b替代就行吧,qwen3.5之后默认带多模态的。至于embedding 4b直接自建就行

  • anklawiet 08-05 19:44
    6

    阿里百炼有看吗

  • nord122 08-06 00:28
    7

    @JH-hhh #0 直接去阿里官方?调用不多,按API收费也不贵。

* 帖子来源NodeSeek
返回