两台DGX实现token自由?

shyrock 2026-08-07 15:26 1

我看某站有人说自己6w8买了两台DGX部署了deepseekv4 flash0731。可以60+token/s。

这标志着本地部署进入平民可用阶段了?

最新回复 (19)
  • raydoom 08-07 15:29
    1

    这价格,对平民来说还有点儿太高了啊

  • 朴实无华 08-07 15:30
    2

    天家,DGX现在起码,4万左右一台吧。。。2台8万

  • OpeneR 08-07 15:30
    3

    我只知道6.8w可以买2000个opencodego.jpg

  • xiaoming00 08-07 15:32
    4

    有点贵了吧,感觉没有什么特别的任务需要本地才能跑,买token更方便

  • shyrock 楼主 08-07 15:32
    5

    小贵。但是这是生产力工具,如果一个人有独立token源,就不怕各种429和5小时限制。干起活来效率高很多。再说这只是开始,价格应该会继续下探。

  • laokke 08-07 15:33
    6

    我有6.8万直接跑滴滴去了. 少走10年弯路

  • 邪恶老登 08-07 15:33
    7

    这年头非保密必要,我觉得真没必要自己研究部署吧

  • shyrock 楼主 08-07 15:34
    8

    差距挺大的,多花一些钱,但是独占token源,一是安全二是稳定哈。不怕429、高峰期变慢、也没有时限。

  • zhao4 08-07 15:36
    9

    6.8w对我这种底层人物来说简直是天价

  • lanvent 08-07 15:39
    10

    能让api 429的速度,我估计它也支持不了。 部署一些无审查的模型玩玩还可以。

  • 白包 08-07 15:39
    11

    机器会折旧的,算你5年折旧,68000÷60=1133r/月,007蹬API都不一定能蹬到这个数

  • OpeneR 08-07 15:40
    12

    尴尬的地方难道不是在于,需要这些要求的人也不会用这种模型吗(

    需要用这种模型的难道不是都是个人有需要的吗


    另外最重要的是,你能够保证dgx的吐字速度比官方快吗(

  • gaohdu99 08-07 15:40
    13

    6-8万RMB,可以6-8年顶级模型tokens自由

  • puppywang 08-07 15:40
    14

    60+ token 的前提是200K的context吧, 如果context放大到1M, 且常年保持了 input token 在 几百K的量级上, 还能维持这个速度么, 没用过 dgx ,只玩过便宜的 jetson agx

  • Doro2077 08-07 15:41
    15

    6w8可以买160年的opencode go,目前一个月flash已经用不完了,还没算电费

  • bobox 08-07 15:41
    16

    感觉问题还是大公司的模型永远都会比本地模型强,短期无解

    最顶级的模型=最顶级的生产力

  • 一只羊蝎子 08-07 15:42
    17

    没那么贵,不开发票的话 31399 差不多

  • shyrock 楼主 08-07 15:42
    18

    api 429不是因为你蹬太猛。。。是因为其他用户跟你一起蹬。。。这就是自部署的优点啊。

  • lueluelue 08-07 15:43
    19

    68000,你可以买50个月的GPT Pro 20X

    哪怕一个月买5个,可能都能撑到GPT 6.4发布了

* 帖子来源Linux.do
返回