跑长任务qwen vs glm哪个更好

花殇喵 2026-08-26 16:54 1

我现在目前在做的是一个java项目,有些大大小小的bug需要修,看网上有人说qwen3.8的长任务碾压glm5.3,glm目前给我的感觉是跑了半天啥都没产出光查看了,qwen还没试,想问问佬友们平时长任务都是用什么模型来跑的

最新回复 (8)
  • 橘猫 08-26 16:56
    1

    隔壁群友有一个播放器的任务要修,最后是选择了用glm5.3做完的。

  • 芝士就是力量 08-26 16:57
    2

    千问除了点外卖,我基本不用,之前被坑怕了


    千问是点外卖最强的AI,不接受反驳

    纯主观,毫无客观

  • 爱长草的云 08-26 17:01
    3

    长任务首先看上下文长度,qwen3.8和glm5.3都支持1M上下文,再看模型能力,glm5.3编程能力还是强于qwen3.8的

  • xodo 08-26 17:01
    4

    glm 的指令遵循算是第一梯队的,而且也有 1m 上下文,还是 glm 吧,qwen 刷分比较严重,他家只有27b小模型表现比较突出

  • VampireFu 08-26 17:03
    5

    可以试试superpowers技能,把任务拆分,按文档实现

  • qdd28 08-26 17:03
    6

    当前是Claude,这两跑长任务呆呆得。

  • 08-26 17:10
    7

    两个模型都没深度用过,我感觉Fable和Sol跑这种长任务应该效果会比较好,不过代价是贵,感觉如果你要效果好,要么是设计出一个比较优秀的loop,可能不需要你人工监督就能做好(也可能介入一点点),代价是贵,因为反复的验证和试错肯定是免不了的;要么是你得人工介入,与模型一起解决问题、复盘,然后去解决,代价是人工介入多,需要引导;在这两种情况下,我觉得只要模型不是太轴,都能用

  • tiankongqishi 08-27 01:16
    8

    我都用过 最终选择使用glm 开发任务够用了 遇到敏感任务切gpt 5.6 sol 辅助一下


    其他人说glm5.3不好用 , 但在我这里非常好用了


    这个只能自己体验下才知道,根据使用的agent工具 和任务内容 框架 个人使用习惯提示词 等等因素 导致每个人的体验都不同


    正好现在glm有一周体验卡 可以试试


    我用的 pi (只安装了pi-maestro-flow插件)

* 帖子来源Linux.do
返回