第二期评测补充: Qwen-3.8, 没有那么差, 因为Qoder有问题

William 2026-07-22 22:21 1

之前快速使用了Qoder测试了一下,发现Qwen-3.8效果十分差, 所以很失望:



这个评测我做过了几期, 之前是GPT-5.5 vs GLM 5.2:

这次也是使用完全相同的提示词(系统+用户提交词), 这次使用的是API调用.
Kimi K3
[k3]
我的系统提示词里有写必要时TDD开发, K3也写了个test, 这似乎不需要TDD
还写了一个迷你GLSL解析器, 这想得够多
用时确实比较长:
[image]
GPT 5.6 sol
[5.6]
似乎…


不过这次使用了Qoder2API: keirouter:



现在用Qoder的Qwen 3.8, 但是感觉Qoder的提示词很差而且不思考(速度很快, 但是思考很少, 现在像codex等IDE也是如此, 多轮会话时就会思考很少), 并且乱用工具, 写个简单的网络经常去调用截图功能等.
本来想自己动手写个Qoder2API的, 稍微看了一下, Qoder是Electron,处理核心是使用go语言开发
在github上找了一下, 看到有人已经实现了: ke…


使用相同的系统提示词和用户提示词做测试:



效果还可以, 所以之前有点错怪Qwen-3.8了, 现在使用IDE/CLI出来的效果十分差, 还不清楚是多轮的原因(因为使用IDE, 第一步都会先查看项目目录的情况)? 还是因为有太多内置工具造成分心? 还是Qoder的系统提示词有问题?


使用了14分钟(之前用Qoder花了3分钟左右), 花费1积分(错峰时间0.01x)(本地API统计input=806 output=57880):


最新回复 (5)
  • fengchris 07-22 22:23
    1

    能输出这么多也是满厉害的 看来3.8还是有点东西啊

  • 无邪气 07-22 22:27
    2

    我这两天用qoder和qoderwork试了下,感觉没没怎么思考就输出了,效果很差

  • deepcake 07-22 22:27
    3

    还以为是GPT呢,怎么前端这么多说明文字

  • William 楼主 07-22 22:30
    4

    不知道为什么了, 使用Qoder就是不怎么思考, 思考很少, 使用了2API就思考非常多, 差不多思考了10分钟, 一半的输出都是思考

  • EUSCE 08-18 23:21
    5

    在使用IDE/CLI出来的效果十分差, 还不清楚是多轮的原因(因为使用IDE, 第一步都会先查看项目目录的情况)? 还是因为有太多内置工具造成分心? 还是Qoder的系统提示词有问题?


    使用了14分钟(之前用Qoder花了3分钟左右), 花费1积分(错峰时间0.01x)(本地API统计input=806 output=57880):



    过了一个月了,我想问问现在qoder+qwen3.8max的组合效果改善了吗?

* 帖子来源Linux.do
返回