关于macbook本地部署ai的疑惑

Yx18456 2026-09-17 13:26 1

大佬们 我刚接触和理解本地模型部署。对ai的接触就是一直跟着gpt官方从第一版发布到现在6.0的一个订阅使用。目前结合平衡了预算,便携,性能后想入手个Macbook pro M5 pro 15/16 48GB,或者等明年发布入手同等配置的M6pro,我想问一下就是这个配置我对于能部署的本地模型的一个配置,量化,模型,输出速度,心里预期是什么。我希望能做到舒适运行28B Q4 30T/s就满意了

最新回复 (8)
  • 卡卡西 09-17 13:27
    1

    qwen3.8-27b 4-5bit 运行还不错

  • Xer56 09-17 13:28
    2

    性能差不多是你所期望的,27b 稠密模型 q4 量化,20-30 tokens/s.

  • Cannon Tang 09-17 13:57
    3

    速度还是太慢并且内存占用过大基本不能干别的事,本地 ai 都是伪需求,不如订阅一根

  • 爱的战士 09-17 14:04
    4

    先想想本地部署能给你带来什么线上模型做不到的,再谈要不要花钱买硬件本地部署

  • popyui 09-17 14:06
    5

    差不多的,可以跑的。


    不过qwen写刘备不好写。所以我还在用gemma。

  • Glen 09-17 14:21
    6

    mac本地部署ai,看你用来干啥了,有没有内网离线的需求?

    而且即便本地部署量化后的版本,还是比不上接入api更快更聪明

    所以 折腾玩玩倒是可以,但是拿来生产力,本地部署还是差点意思

  • yomi 09-17 14:50
    7

    你现在这个就是伪需求, 模型能力不行还慢, 这点钱买个plan估计能用很久

  • Yx18456 楼主 09-17 15:06
    8

    关于需求,主要是如下考虑。

    第一呢我的工作是IT,想有本地部署模型的经验,上手,调教,使用的实际经历,数据,拿得出手也能在资料上填上几笔好看的,以及可以应对未来工作可能出现的需求。算是个学习过程吧。

    第二呢,是本地部署可以去审核,去敏感化,拿来做些线上模型不允许探讨的事情,话题,也不是啥大事,整点盗版资源这种偷鸡摸狗的小事情。还有聊一些比较敏感,线上Ai,包括国外模型都不允许聊的内容话题(也不是什么坏事,就是现在的ai真的太敏感了)

    第三呢,是我经常坐飞机,想在坐飞机的断网这几个小时有个小Ai在本地,可以做点轻量化的小事情。比如巩固一下一些简单的IT和编程相关知识啊,学点小技巧,写几行小程序,一些简单基础的代码语法复习。可以给他提前准备好数据库,材料库,去线下提取。然后呢,可能喜欢写一些小东西,让他当个提供建议的助理助手。

    第四呢,我的使用需求很多东西并不需要非得最聪明的前端模型,就是让我退回刚发布的gpt3.5也是可以够我用很多东西的。这种活儿交给本地模型干还能省点token

* 帖子来源Linux.do
返回