Qwen3.8-Flash-Next的跑分超过deepseek v4f 能平替吗

yyz82 2026-08-26 21:35 1


125B暴打规模大两倍的模型,原生上下文 262k,可扩展至1M

价格为 每百万 Tokens 输入1元、输出3元,没说缓存价格


各位佬用了吗?能不能平替v4f呢?

最新回复 (19)
  • lucienfc 08-26 21:38
    1

    还是自己的体感更重要,跑分啥的真是怕了

  • 落寞书生 08-26 21:38
    2

    看起来性能指标全面强于qwen3.8 27b模型,gguf出来后本地跑下,看下是否名副其实

  • Taosu 08-26 21:39
    3

    “跑分没输过”,而且只说输入输出价格,可能缓存不便宜 ^-^

  • yyz82 楼主 08-26 21:41
    4

    官方价格是这样的,不知道第三方会什么价格,opencode那些平台后面应该也会上

  • 咪叭 08-26 21:41
    5

    哎,好大的模型!跑不动耶 ^-^


    小一点就好了

  • coupile 08-26 21:42
    6

    问题是qwen的价格不便宜啊,之前几百b的模型就很贵了

  • Neige 08-26 21:43
    7

    还有人没意识到千问是跑分领域大蛇,定价领域神人吗

  • 落寞书生 08-26 21:44
    8

    激活参数不大,大一点内存,cpu混合推理应该也能跑

  • sonderz 08-26 21:45
    9

    该说不说,qwen给我的印象一直都是跑分没输过 ^-^

  • 余君 08-26 21:46
    10

    qwen小模型本地部署还可以 跑分的话看看得了,毕竟刷分是传统艺能

  • 点点点…点娘! 08-26 21:47
    11

    和Deepseek的方向一致


    N-Gram/Engram/条件化记忆应该是未来LLM的一个Scale Up方向

  • fengchris 08-26 21:48
    12

    重点看缓存 目前还没上线API 等一等

  • Y05H1 08-26 21:48
    13

    但是DeepSWE不容易被exploit 因为数据集不像SWE Bench那种都是能在GitHub上找到的

  • Doro2077 08-26 21:48
    14

    ^-^难吧,目前我没有看见一个主力用Qwen模型的人,v4f倒是挺多人主力在用的

  • fenglin 08-26 21:49
    15

    他主要还是价格问题,能力其实还可以。

  • flyfre 08-26 21:58
    16

    模型能力不行,如果不对标跑分优化,真是没人用了

  • kimi 08-26 21:59
    17

    不好

    我已经给过他机会很多次了

    还不如Grok和GLM,甚至还不一定有比DSV4FGA好

    更别说O/和A/了

  • wwtest 08-26 22:02
    18

    27B 表现不错 接入qoder cli 表现远超预期 完全打破以前qwen 中看不中用的 刻板印象

  • Nec 08-26 22:04
    19

    我就用27b的,专门拿来渗透的,晚上写好步骤和目标,早上起来收菜,这几天已经干死好几个菠菜的了 ^-^

* 帖子来源Linux.do
返回