Gemma4 12B部署体验,5090单卡,80+tokens/s,使用多模态,记得升级llama.cpp到b9503
yeyucca
2026-06-04 14:10
1
最新回复 (16)
-
superloki7 06-04 14:161楼 -
MineMine 06-04 14:162楼 -
yeyucca 楼主 06-04 14:413楼 -
Ruby 06-04 15:104楼 -
zhaoyu 06-04 16:085楼 -
倚栏听风 06-04 17:436楼 -
paopao 06-04 17:447楼 -
倚栏听风 06-04 17:458楼 -
倚栏听风 06-04 18:059楼 -
にたま懂个じば 06-04 18:1210楼 -
hhnnjjcc 06-04 18:2711楼 -
yeyucca 楼主 06-04 21:0513楼 -
Belope 06-05 18:0814楼 -
yeyucca 楼主 06-05 18:3115楼 -
Belope 06-05 18:3616楼 -
NobodySU 06-08 05:5317楼
* 帖子来源Linux.do
附近帖子
- ↑[开源] AxonHub 1.0 ,我想做的 AI 开发平台
- ↑不久前竞技场发了一个博客,介绍他的agent模式 说是多工具支持,包括图片生成 好好好 接了个大善人
- ↑难道,Codex-Free就指的没有出路了吗。。。
- ↑大胆猜测 | ChatGPT Pro 订阅爆新 Bug?
- ↑0刀卡,5点50过期
- 📍 Gemma4 12B部署体验,5090单卡,80+tokens/s,使用多模态,记得升级llama.cpp到b9503
- ↓欢迎来到 LINUX DO!
- ↓搞了一晚上,到最后“进度”还是 0%,迷茫了睡了
- ↓[开源推广] 反代commandcode-proxy - 把 Command Code 订阅变成 OpenAI/Anthropic 接口
- ↓lobehub在vercel上部署失败
- ↓100万刀GPT,来蹬!




我去试试 31b
比deepseek70b聪明啊