有没有大佬测评一下 Qwen3.8

wKong753900 2026-07-20 09:41 1

如题,跟 K3 对比怎么样

最新回复 (33)
  • v2mo 07-20 10:34
    1
    每次发布,都说世界前列。

    实际一用,就崩塌。

    大家可能都免疫了。
  • v2mo 07-20 10:35
    2
    @v2mo 我指的是 qwen 每次新版发布哈
  • my101du 07-20 10:46
    3
    自从领了两杯送的奶茶后就卸载了。 回答其实中规中矩,比元宝还准确及时一些。 但是总觉得哪里用起来怪怪的。 另外就是 B 站都放了大量千问的广告,非常 low ,令人怀疑它到底想干什么。
  • keshawnvan 07-20 10:49
    4
    @my101du 千问 C 端太迷了,既不舍得给好模型,又不好好打磨产品,那花钱推广干嘛呢?
  • 027creed 07-20 10:56
    5
    @keshawnvan 都想摘果子,但是没有人种树,kip 的导致一切只看结果,派系斗争严重,所以阿里现在越来越拉
  • catazshadow 07-20 11:13
    6
    时间久了,之前只配呆在中下层的人被公平性要求安到了决策层,所以所有的大型组织最后都会灭亡
  • QlanQ 07-20 12:07
    7
    就 qwen 这样的,明明就是一般,为啥还这么贵,就不理解
  • shawnvan 07-20 13:34
    8
    qwen 主要还是做 2b 市场吧
  • Daitabashi 07-20 13:38
    9
    基座模型吧 似乎没(怎么)做后训练
  • wKong753900 楼主 07-20 13:59
    10
    哈哈,本来还想试用一下的,现在看还是先观望吧
  • renzhe8102 07-20 15:09
    11
    說實話, 比上週某個新模型還是強的,但是感覺都是刷分
  • ufan0 07-20 15:18
    12
    好奇有在商业订阅百炼的吗?垃圾到开个帖都吐槽不完。
  • CloudnuY 07-20 15:51
    13
    用 chat 试了一下,单页面 HTML 效果挺不错的
    https://chat.qwen.ai/s/t_7137c533-5109-4c1f-a67a-435e48a6bd04?fev=0.2.74
  • techmale 07-20 16:14
    14
    中大型项目配合高质的 AGENTS.md 、tests 、SOP 等情况下。Codex 是最最最最靠谱的。没有之一。
  • Yesr00 07-20 16:18
    15
    我用 QWEN 感觉就是在被它薅。。。它家自带的 IDE...动不动就死循环。。。疯狂吃钱。。。我都想报警了。。。
  • zhonghao01 07-20 16:19
    16
    qwen 每次新模型都吹得天花乱坠,多牛逼多牛逼,但是实际一用,太垃圾了,完全配不上价格。

    qwen 的新模型高产似母猪
  • cb74883 07-20 16:23
    17
    他自己 Qoder 里面的定价是 0.5 ,GLM5.2 定价是 0.6 ,Kimi-K3 是 0.8 ,可以参考一下。
  • kevan 07-20 16:26
    18
    每次发布,都说世界前列。
  • karld 07-20 16:27
    19
    垃圾
  • unregister 07-20 16:30
    20
    V 站没有一个人客观的,都是一句话的,别来这问了
  • unregister 07-20 16:35
    21
    X 上点赞的很多,到这里就是垃圾的不行。
  • keshawnvan 07-20 16:54
    22
    体验了一下:
    1.速度很快,快的不像 2.4T 的模型,可能激活参数不高。
    2.在 Qoder 里一折,导致负载很高,可用性很差。
    3.后训练做的确实一般,查看 AGENTS.md 和知识库不积极。
  • levn 07-20 17:07
    23
    测试了一个问题,用本地的 397b q2 来检查,发现一处错误。
  • xiaokaitongxue 07-20 17:17
    24
    只能说 现在打折 薅羊毛用用还行。
  • Seanfuck 07-20 17:20
    25
    @CloudnuY 这个挺不错了。
    不管有没有吹,qwen 在国内总体算是第一的。
  • xiaomushen 07-20 17:24
    26
    V 站上都是用 Fable5 和 GPT5.6 ,一般看不上这些国模,更别说用了
  • lostwolfkf 07-20 18:13
    27
    这是 qoder 里的倍率,我不信他又便宜又好
  • ifoto 07-20 18:15
    28
    用的 3.7 写的确实一般。错误也多
  • lscho 07-20 18:22
    29
    qwen3.8 拉中拉。。。写个样式都写不好,两个按钮大小不一致,让他改成一致的。因为 css 类名用了 Tailwind 的风格,他直接判定项目装了 Tailwind ,连 package.json 都不看就说改好了。。。然后故意没说原因,说没生效,提示两次还没处理好。
  • ebushicao 07-20 19:19
    30
    qwen 拉完了,上次的 3.7-max 也是吹的天花乱坠,用起来有时候还没 deepseek-v4-flash 聪明。kimi 虽然 2.7 拉了一坨,但是 k3 确实有点东西。

    看到#3 楼说到了之前千问的宣传,我顺带吐槽一下,当时我说要点奶茶,给我推了一堆奶茶,我说换一批便宜点的,结果给我返回一批蔬菜水果... 拉到我真的绷不住。
  • Hilalum 07-20 19:23
    31
    不管咋的,Qwen3.6-27B 简直是神
  • wxjer 07-20 20:40
    32
    有没有可能分跑分版和普通版,参考国内手机送评/跑分内幕
  • PopRain 07-20 20:46
    33
    千问插件自动变 Qoder 社区版,credits 突然清 0 了 ,白嫖不了也就不用了. (订阅有腾讯的)
* 帖子来源V2EX
返回