gpt5.6luna和deepseek v4 flash的直观对比

远坂凛的宠物 2026-08-04 02:48 1

如题,下面两轮对话,在有规划模型引路+跑subagent能力都够用+花销都可以忽略不计的情况下,你更愿意回复哪一条呢?


我的场景是需要边开发边写文档和日志的,然而目前的harness还很少能在开发的sub agent和写文档的sub agent各自指定不同的模型。然而gpt的文档能力和抓重点能力……


如果遇到触碰到小模型能力上限的攻坚场景,我首选肯定是直接用sol,sol依然是最有性价比的旗舰模型。


但是当在一个大任务里开子代理打杂用的时候,你真的愿意用一个黑化连篇罗里吧嗦抓不住重点的luna吗?


如果能个给文档任务和执行任务分开指派模型,我肯定很乐意他俩一起用。



最新回复 (3)
  • sakura0v0 08-04 02:59
    1

    这个是什么agent啊,可以多个model一起用哎

  • 远坂凛的宠物 楼主 08-04 03:01
    2

    droid,可以给规划执行以及最后的总结验证指定不同的模型。


    我用过的harness不多,不过我感觉应该不是啥稀罕功能?


    我感觉优化不大行缓存命中率蛮低的!

  • 远坂凛的宠物 楼主 08-04 03:51
    4

    刚刚好像发现droid可以指定让validator写文书,woker专注执行


    那就好办了,让luna当woker,负责执行和实际的审查,dsf当validator,专注写文书


    虽然和官方的推荐实践差得有点远(woker负责一切编辑,validator负责任务后审查和总结),不过也算找到搭配干活的方法了

* 帖子来源Linux.do
返回