各位佬好,准备买显卡本地跑大模型,两张卡之间纠结,求大家给点建议。

Mr.Candy 2026-08-25 10:51 1

【用途】


- 模型:Qwen3.8-27B,GGUF Q4 量化(Q4_K_M)


- 上下文:200k token 以上,主要是长文档/代码仓库整库理解


- 系统:windows11,ollama


【候选】


--------- RX 7900 XTX --------- Radeon AI PRO R9700


显存 ----- 32G GDDR6 --------- 32G GDDR6


带宽 ------ 960 GB/s ----------- 640 GB/s


架构 ----- RDNA3 (gfx1100) ---- RDNA4 (gfx1200)


功耗 ----- 355W ---------------- 250W


价格 ----- 便宜约 2000 ----------- 贵约 2000




预算1万左右,或者还有啥卡推荐吗,主要是跑大模型,游戏兼顾,但玩的少,偶尔玩黑悟空,现在是4070s,打出出掉换一个

最新回复 (12)
  • oiiai 08-25 10:54
    1

    你这个预算,我说实话,用不爽的,有精力折腾就弄,想当一等公民还是N卡

  • lovesusu 08-25 10:54
    2

    如果非要这两个选的话, 那最好就r9700, 因为是RDNA 4架构, 支持的量化格式更丰富, 至于性能我就不清楚了

  • Mr.Candy 楼主 08-25 10:57
    3

    想当一等公民



    等哪个N卡呢,肯定想当一等公民的

  • xinmodevil 08-25 11:05
    4

    先找个平台充钱体验下,估计你以后都不会有个人跑大模型这种想法

  • Mr.Candy 楼主 08-25 11:19
    5

    好主意,有平台推荐吗,主要是我现在4070s跑q2精度跑的还行,就是token只有2-3tok/s,想换个卡增强体验

  • xinmodevil 08-25 11:22
    6

    硅基流动,我看它有很多乱七八糟的模型

  • promise 08-25 11:22
    7

    2080ti魔改22G+ddr5 32G内存跑q4km64k稳定30-43tok/s,感觉一般,看有些问题反馈q5要比q4强很多

  • Mr.Candy 楼主 08-25 11:23
    8

    2080ti魔改22G



    2080ti魔改22G多少钱,其他配置我和你差不多,只要能跑起来就行,我现在这个4070s只有12G显存,太痛苦了

  • LOSTZZZ 08-25 11:23
    9



    跑这个好像还行

  • promise 08-25 11:24
    10

    现在小黄鱼应该15-22吧,有阵子没关注了。

  • Mr.Candy 楼主 08-25 11:25
    11

    佬,你说的是模型不行吗?可能佬还没体验过Qwen3.8 27B,这个模型无敌了,写代码已经处于能用的地步了,特别是无审查版,还有其他妙用。

  • promise 08-25 11:25
    12

    网上评测24G卡跑q4是甜甜圈.4090可以开更高的上下文

* 帖子来源Linux.do
返回