佬们如今买什么消费级显卡比较好

lij768423 2026-07-22 19:29 1

想请教一下各位长期跑 AI 的大佬,最近选显卡有点纠结

环境如下

系统:Ubuntu 服务器端

100% AI,不打游戏

主要跑:

ComfyUI(FLUX、SDXL、ControlNet、LoRA 等)

Wan / Hunyuan Video 等视频生成

PyTorch 开发、推理

暂时没有 vlm 需求(已经实现 grok 自由)

经常长时间满载运行,希望稳定性优先。


目前有两个选择:


二手 22000 5090d 32g

RTX 4090D 48GB图威 全新 24000


我主要纠结几个问题:

1.48GB 显存对于现在和未来 2~3 年的 AI 工作流(ComfyUI、视频生成、本地 LLM)价值到底有多大?

2.图威 4090D 48GB 的稳定性怎么样?有没有长期(几个月甚至一年以上)跑 AI 的朋友?有没有遇到显存、驱动、CUDA、ECC(如果有)或者其他问题?

3.Linux 下兼容性如何?PyTorch、CUDA、ComfyUI、vLLM、llama.cpp 等是否有坑?

4.我也逛了一下站里面,好像有佬说现在 48g 显存优先级不是很高而且 50 系列架构新有新的什么算法

求各位佬解答,我还是这一块的新手

最新回复 (11)
  • hyt2 07-22 19:45
    1

    我将对此进行关注,可不可以上专业卡呢?如果可以的话

  • Tearlaments 07-22 19:49
    2

    现在二手的都这么贵吗 哈人啊 而且我觉得很多大模型5090都不够

  • sauterne 07-22 20:03
    3

    我还在用2年前买的 二手3090

    不过我建议是:

    1.先看显存大小,12G(包括)以下的别考虑了

    2.非N卡别考虑了


    至于佬友说的48G 对于个人来说的话,推理基本够用了。

    因为商业级模型,个人也跑不动,个人级模型 48G够用。

    对于一下小的微调也够用


    从使用角度:

    如果你要训练/微调不如直接上服务器,本地场景下还是推理为主。

    48G 很稳

    参考:我自己24G的3090已经足够一些正常的日常推理任务,只不过之前一些生成视频的模型会爆显存,生成图的,16B以下的LLM推理,或者32B的量化推理 都没啥问题

  • MiluZz. 07-22 20:08
    4

    你本地AI消费级显卡可以不用考虑的,基本上是玩具,玩一阵子之后ai就没用

  • lij768423 楼主 07-22 20:08
    5

    预算最多三万了呜呜,不然我觉得 rtxpro6000d 很不错

  • lij768423 楼主 07-22 20:09
    6

    真的吗,本地大模型肯定不跑,主要是向量嵌入然后拿来建知识库什么的,自动化剪辑生图乱七八糟的,我看我朋友在做心里痒痒的

  • lij768423 楼主 07-22 20:10
    7

    不跑模型佬,本地模型没啥价值,其他功能生图抽卡之类的

  • MiluZz. 07-22 20:11
    8

    你建的知识库其实用不到多好的显卡,或者使用云端的AI就行了,反正也不贵。本地的自动剪辑,如果你要用本地部署的显卡,其实顶多就玩一玩nsfw

  • kkkqkx 07-22 20:13
    9

    向量嵌入连独立显卡都不需要,跑个fp8的0.6b模型用核显+共享内存就足够了。不需要vlm嵌入的话0.6b已经差不多够用了

  • wugeng 07-22 20:15
    10

    不跑模型,5060 16g足够。5090还要天天担心烧接口。

  • fcten 07-24 12:22
    11

    本来建议 4090D 48G 的,但是现在都 2.4w 了吗…那我觉得 5090 也挺好的。


    文生图/视频目前不需要 48G(原因在于目前的开源模型)。但是 PyTorch 开发、推理 可能需要,看你的研究场景。

    4090D 48G 我用了一年多了,目前没出过问题。软件生态上没有任何兼容性问题。

    50系增加了 NVFP4 支持,对打游戏可能有点用,目前对 AI 的用处不大(推理大部分不支持,训练几乎完全没用)。不过 50 系 GDDR7 显存带宽增加了,对于本地 LLM 推理速度提升比较明显。

* 帖子来源Linux.do
返回