预算 2 万,自建 ai 服务器效果如何?

星火了原 2026-06-24 21:01 1

弄几天没玩明白 plus 的额度问题,总感觉他应该不够高强度开发。

如果我上一台 64g 的mac 设备,上开源的 qwen 之类的,是否能满足高强度开发?效果如何?

当然,如果做架构之类的,开个 plus 来做。

这种方案是否也可行?

最新回复 (19)
  • 钟阮 06-24 21:02
    1

    先不说别的,保底要用GLM-5.2这种能力的吧,744B的显存起步[之前不知道哪听到的,算最小占用就是模型本身占的硬盘空间],FP8量化,


    然后还有别的上下文、缓存啥的,不得来个8卡了

  • CodesMonkey 06-24 21:02
    2

    要不你自己算算2W够买多少ds flash?

    你自己部署的qwen能比flash强?

  • KuYun 06-24 21:03
    3

    再加2个0吧,200w差不多够了

  • Jvs 06-24 21:03
    4

    感觉不如买 订阅来的实际,折腾的时间成本也要算的,还有维护,2w都不知道买多少 token了吧,还随用随买,自由度也有

  • Lichi_c 06-24 21:03
    5

    先算算能买哪些资源,然后去找下可以部署的模型试用下,然后你就会放弃的 ^-^

  • z 06-24 21:04
    6

    开源模型能力还不足以支撑你的大规模开发任务吧

  • 星火了原 楼主 06-24 21:05
    7

    主要考虑的是,高强度使用的话,token 应该也很贵了吧。比如现在 plus缩水成这样。

  • Neptune 06-24 21:05
    8

    2万是不是太异想天开了,我一直觉得本地部署对话类模型是纯伪需求,大公司都用订阅,难道个人隐私比大公司的隐私还值钱

  • 星火了原 楼主 06-24 21:06
    9

    比如让写一个框架,比如基于 tp 的后台管理系统、angular、yii 等这种级别的框架做底层来做开发。开源的也搞不定?

  • 星火了原 楼主 06-24 21:06
    10

    不是考虑的隐私,是觉得总担心 token用量,太容易焦虑了。

  • azurs 06-24 21:08
    11

    2w还是有点异想天开了。。。开源能搞定但你这个预算搞不定啊,而且既然说是高强度使用了,吞吐速度不考虑下的吗

  • 星火了原 楼主 06-24 21:08
    12

    看起来大家都推荐使用 deepseek 之类的。如果是这样的话,哪家的目前写代码能够力强一些?另外需要做项目架构,是不是 开个 gpt 的 plus 基本就可以了?和 cc比呢(架构方向)

  • 潇潇 06-24 21:08
    13

    2W就想本地AI还是太嫩了,部署个量化的弱智也没意思

  • 荒野的烟雾 06-24 21:08
    14

    比较难,能够很好的做代码开发的开源模型目前估计就glm-5.2,qwen-3.6吧,这两个2w肯定部署不起来的。

  • 星火了原 楼主 06-24 21:09
    15

    问过 gpt,mac studio 可以做到 70 左右。但是不知道质量如何。当然,新一点的,价格可能至少 3 万+起了。如果说能达到理想交易,加预算倒也可以考虑,大不了几个朋友一块用。

  • airyea 06-24 21:09
    16

    按照 2 万预算的标准去租相应的硬件,拿回来测试。如果能满足了,就买。如果满足不了,把租的设备退了,老老实实的去购买相应的大模型的接口。

  • sahara 06-24 21:09
    17

    如果不是涉密项目的话,不建议自建ai服务器。不过以现在的热度,说不准你现在的2万服务器,用1年后还能赚点呢

  • Neptune 06-24 21:09
    18

    你现在日均tokens用量多少?不能还没用就开始焦虑上了吧,站内的佬们能日均1亿的都少。你知道2万含金量多大吗,对于订阅来说能买多少tokens了吗。

    佬我想直接点破你的小心思,现在你处于差生文具多的状态,首先你用一个月订阅试试,最差的国模订阅都比开源的小模型强很多。

  • 星火了原 楼主 06-24 21:10
    19

    这个好,没想到这一块,回头试试这种方案,对比一下。

* 帖子来源Linux.do
返回