纯好奇, m1的 ma16G+512能不能跑无损版的Deepseek V4

屑狗爱猫 2026-08-24 12:06 1

(>v<)就是本人单纯好奇,苹果的Mac16G+512可以部署Deepseek V4满血版吗,就是专家模式也不砍掉,速度慢点无所谓的那种。

好奇能不能运行内存不够,硬盘来凑的这种打法( ´•︵•` )

在设备性能有限的情况下,以更长的运算时间换取高质量的模型推理结果。

不知道目前有没有对应的研究,或者开源方案。

最新回复 (14)
  • Scheme 08-24 12:06
    1

    你这个问题吓到我了

    人家那个512是内存 不是硬盘

  • 泰迪 08-24 12:07
    2

    部署千问3.8都勉强,还想无损dsv4

  • 爱伦·坡 08-24 12:08
    3

    那16*32等于512

    我可以用32台mac同时开跑吗?

  • 合本丶 08-24 12:08
    4

    不行,d4f都有200+b参数,你这16gb哪怕用1bit跑都装不下,更别说16g里面还要运行系统软件等等

    如果用512硬盘来跑,输出速度可能几分钟1token ^-^

  • wintter 08-24 12:08
    5

    延遲呢 不考慮延遲 512也不夠吧

  • ooc7 08-24 12:08
    6

    理论上, 专门开发一个推理服务器, 也许能做到, 可能几分钟吐一个 token 出来

  • 🛡️Rice R. Rug 💛🍋⭐️💫 08-24 12:09
    7

    请问,1000块可以不可以买深圳湾一号,纯好奇

  • AbLee 08-24 12:09
    8

    佬这个问题让我想起了好像还真有这么个项目,当时那个大佬成功做到了31 s/token

  • 黑化喵喵 08-24 12:10
    9

    m1好像不行吧 m4 估计可以^-^ 走雷电链接 之前有个开源项目 后面苹果修复了 雷电直通^-^

  • thereisnospoon 08-24 12:10
    10

    权重offload的项目有很多吧,但是太慢了没啥意义的。另外你磁盘寿命不要啦

  • 爱伦·坡 08-24 12:11
    11

    深圳湾一号啊

    真的可以


  • ooc7 08-24 12:17
    12

    问了下 AI, 如果不考虑吐字速度和磁盘寿命, 技术上还是可行的 ^-^

  • AbLee 08-24 12:17
    13

    GitHub: GitHub - JustVugg/colibri: Run frontier MoE models on hardware you already own — pure C, zero deps, experts streamed from disk. Tiny engine, immense model. 🐦 · GitHub

    作者: 论坛 ID 为 vforno(GitHub 上为 JustVugg),2026 年 7 月发

  • jkcltc 08-24 12:52
    14

    逐层加载+逐层卸载。速度先别管,就说能不能跑(

* 帖子来源Linux.do
返回