Ternary-Bonsai-2-27B-PQ2_0.gguf 实测很拉

Ruan222123126 2026-10-01 15:00 1

测试了自己搭的框架,还跑了大象牙膏测试,所有测试没一个能跑完的,不管是前端还是后端,没一个能编译的,且稳定进入死循环,是我的问题,还是模型的问题?不是说能达到 27b 80%90% 的能力吗,到底怎么能达到,感觉拉完了(当然,快是挺快的,但是没什么用)

最新回复 (4)
  • Ruan222123126 楼主 10-01 15:33
    1楼



    Deepseek 是这样评价的,gemma是12b

  • NukaColaM 10-01 16:49
    2楼

    试试Q1?

    有些测试报告Q2比Q1还拉。

  • Ruan222123126 楼主 10-01 17:02
    3楼

    OK,一会测,我现在在测那个 qewn3.6 35B。实测牙医后端数据库已经跑出了最高 378 的成绩,在牙医的排行榜里已经超过了 Kimi2.5 了

  • Ruan222123126 楼主 10-01 18:37
    4楼

    不行,过不了编译主要是会陷入死循环,总是会陷入去做同一件事里,表面上看,确实会比 Q2 好,因为 Q2 直接就调用工具进入死循环了,直接就调用工具失败了,它调用工具倒是没问题,但是会无限地进入修改同一份文件的死循环里

* 帖子来源Linux.do
返回