4090+32g本地能部署什么模型

Aikaid 2026-06-25 17:40 1

最近也不咋打游戏了,4090也闲置了,先本地部署个模型试试,完全没有折腾过,站内有很多天才佬可以指点一下

配置13700k+32g+4090 24g

最好支持多模态,不需要代码专精,毕竟能跑就行

最好能大概讲下部署教程,然后部署好后怎么接入newapi或者sub2这种…

最新回复 (16)
  • Novert 06-25 17:43
    1

    首先你要确定部署本地模型是为了干什么

  • Aikaid 楼主 06-25 17:44
    2

    1.纯折腾学习一下

    2.可能的话处理一些简单的文本编写汇总,office文档处理

    3.接一个hermes(想法)

  • 酒寄彩叶 06-25 17:44
    3

    ollma好像拉模型部署挺快的,一般部署q4-q8,q8一般就是多少g显存能放多少b的模型,q4就是可以放双倍大小的,内存能卸载但是不推荐,速度受内存带宽影响可能吐字比较慢

    个人经验,有错误其他大佬可以指出

  • Neige 06-25 17:45
    4

    折腾着玩的话可以,要是真的想用的话可能电费比v4 flash的token贵

  • Aikaid 楼主 06-25 17:45
    5

    hhh,应该是这样的,不过首要还是学习折腾一下

  • 爱长草的云 06-25 17:47
    6

    打开下面这个网站就可以看到当前电脑能部署哪些模型了

  • 𝕐𝕖𝕒𝕙 06-25 17:51
    7

    有工具能检测你的系统配置来给你模型部署的建议

    叫 llmfit,GitHub 上有

  • Konzia 06-25 17:58
    8

    可以试试Qwen3.5 9B,Qwen3.6 27B的Q4/Q6量化,Gemma4系列。昨天阿里还开源了“首个在单一模型中覆盖七大智能体交互领域的语言世界模型”Qwen-AgentWorld-35B-A3B,可以折腾把玩一下 ^-^

  • caoming 06-25 18:00
    9

    9B参数量的模型 用llama.cpp或者lmstudio部署,或者30B的模型4位量化版本。调调参数应该跑起来没啥压力

  • Wong Marco 06-25 18:01
    10

    我们的配置比较近似。本地试下llama.cpp server+Qwen3.6-27b Q4,应该能满足第二点的日常。Hermes还在折腾

  • 啁啾 06-25 18:12
    11

    推荐 qwen 的 35B-A3B 模型。跑 27B 应该也跑得动,就是很慢

  • sleeepy 06-25 18:12
    12

    直接打或加到powershell profile, ps打run-llama就可以开始在任何支持openai/anthropic-compatible provider的地方用。显存会占用23G,想有更多context可以kv用q4_0。


    function run-llama {
    & "E:\tmp\llama\llama-server.exe" `
    -m "e:\tmp\LMStudio\models\Jackrong\Qwopus3.6-27B-v2-MTP-GGUF\Qwopus3.6-27B-v2-MTP-IQ4_XS.gguf" `
    --mmproj "e:\tmp\LMStudio\models\Jackrong\Qwopus3.6-27B-v2-MTP-GGUF\mmproj-F32.gguf" `
    --no-mmproj-offload `
    --alias "qwen-27b" `
    --port 61823 `
    -c 122880 `
    -ngl 99 `
    -b 512 `
    -ub 512 `
    -fa on `
    -np 1 `
    -ctk q8_0 `
    -ctv q8_0 `
    --spec-type draft-mtp `
    --spec-draft-n-max 2 `
    --spec-draft-n-min 0 `
    --temp 0.8 `
    --top-p 0.95 `
    --top-k 20 `
    --min-p 0.0 `
    --presence-penalty 0.0 `
    --repeat-penalty 1.0
    }
  • arnzh 06-25 18:30
    13

    Qwythos-9B-Claude-Mythos-5-1M-GGUF

    gemma-4-12B-agentic-fable5-composer2.5-v2-3.5x-tau2-GGUF

    最近2个新贵。

  • 比奇堡传奇交易员 06-25 18:52
    14

    佬 这个名字这么唬人 有什么说法吗?神话5都来了 神话5监督训练的?

  • arnzh 06-25 21:17
    15

    huggingface上开源的啊,总是用蒸馏的数据微调了一下呗,这两天比较^-^。

  • 九十 06-25 21:19
    16

    hugging face差不多相当于llm界的github了,你可以上面把玩几个模型,参照下大概能跑多少b的版本,如果不确定也可以问GPT

* 帖子来源Linux.do
返回