qwen3.8flash真神了

doro 2026-08-30 22:05 1

千问小模型水平真不错, 125B真的四两拨千斤了,体感下来,感觉比得上opus4.8水平,感觉真的很夸张,125B,半年前没人相信这么小的可部署模型达到完全可用的地步,甚至有点小强度,我甚至可以跑在本地的mac上

最新回复 (19)
  • kuzi 08-30 22:06
    1

    真有这么强吗比v4flash小还更强 ^-^

  • doro 楼主 08-30 22:08
    2

    体感下来比v4flash强不少,可能和v4pro-0813才差不多,我本来以为v4flash 300b已经很逆天了,但是这个125B真的震惊我了

  • limitpea 08-30 22:09
    3

    佬 你是用什么配置部署的?占用情况和速度如何 ^-^

  • Kren 08-30 22:12
    4

    没有mac,但是我有佬友们,暂时能应付日常使用

  • Taosu 08-30 22:13
    5

    好奇qwen3.8-flash-next和qwen3.8-flash哪个更强,前者甚至还没在千问平台上线api

  • parksi 08-30 22:14
    6

    qwen3.8-flash



    这个模型存在吗,好像搜不到这个模型的消息

    FX:找到了,这个模型好像没多少讨论量

  • gordontsm 08-30 22:14
    7

    真的有这么强吗,还挺好奇要试试啦哈

  • doro 楼主 08-30 22:16
    8

    mac mini的128g内存占满,大概30-50t/s,实际用下来感觉可能还是用2080ti部署性价比更高,看到有人实测双2080ti加128 g ddr4都能跑出30t/s,价格不到1w

  • leonlee 08-30 22:16
    9

    请问是用于哪方面的呢?感觉不同模型在不同方向上的长处是不一样的。

  • lixius 08-30 22:17
    10

    这两就是同一个模型吧,官方 api 用 3.8 flash 名字上架

  • doro 楼主 08-30 22:18
    11

    代码能力,长编程能力要感觉好于v4 flash,小模型的长编程能力一般不行,但是这个模型要优于很多模型

  • Chin 08-30 22:20
    12

    Mac mini有128G版本?

  • ryj 08-30 22:20
    13

    和glm5.3-flash比哪个强?

    就是qoder送的免费额度太少了就500credits​^-^

  • enget 08-30 22:21
    14

    decode速度没有意义,你给他怼个 100k 上下文进去 + 并发 3 个任务,prefill 速度就炸了,基本上没有办法接入自己的 cc 用。


    想要爽用感觉得买 m5ultra 256g/512g

  • doro 楼主 08-30 22:23
    15

    我感觉是千问好一点,GLM这个模型总感觉怪怪的,代码能力不如跑分,可能是用的人多了降智了吗

  • Ringo 08-30 22:24
    16

    自部署的吗?下午试用了下没啥感觉,幻觉有点严重,体感远比不上5.3Flash。

  • doro 楼主 08-30 22:25
    17

    知识上确实不如,因为太小了,但是代码真的强一些

  • fengchris 08-30 22:28
    18

    感觉代码上27b的更强 dense模型还是有点东西

  • wayned 08-30 22:29
    19

    你 Mac 什么配置?内存是多大的呢?

* 帖子来源Linux.do
返回