本地部署ds的v4f,想做到官网速度的50%以上,需要什么配置的mac?

Cyrus9527 2026-08-29 23:31 1

想搞一个本地模型,虽然知道配置越高越好,但是多少要考虑下购买成本,要是有个本地模型,这样想干啥都不需要考虑额度了。

最新回复 (6)
  • Cyrus9527 楼主 08-29 23:33
    1

    不知道v4f能不能这么简单部署,或者差不多的模型?好像qwen3.8最近有个模型也挺小挺好用的。

  • emailuser 08-29 23:35
    2

    这个问题直接交给ds 让他自己回答

  • RiverMao 08-29 23:37
    3

    如果是公司想跑可以考虑, 个人不建议

    给你个参考, 我mbp32G跑过32B的模型, 速度只是说得过去的水平

  • 快乐的出帆 08-29 23:39
    4

    吃不下这么大的模型

  • KazeRush 08-29 23:41
    5

    5张h200,内存128起步

  • insolitude 08-30 00:00
    6

    我是每两个NVIDIA dgx spark部署一个v4 flash,感觉速度就比官网慢一点,但是坑挺多的,比如dsml工具调用泄露,vllm部署导致思考泄露到正文里,偶尔遇到的无限循环。而且还得自己接web search,fetch。还没有视觉能力。而且deepseekv4 flash还没有智能到能够自己修复自己,我用4个spark,搞了两个v4,接了两个Claude,让他们互相修上面的问题,搞了两天还不行,也就是即使花了怎么多,还是得买api,用更智能的模型来修复自部署潜在的问题

* 帖子来源NodeSeek
返回