咨询GPT5.6-LUNA MAX和Deepseek 4 flash max的比较

Ryan 2026-08-08 07:56 1

各位佬,请问大家有没有对比过GPT5.6-LUNA MAX和Deepseek-4-flash max?


我在agent里用下来,发现Luna MAX比ds4flash要差很多。luna max调用正确工具的能力明显偏弱,下图就是一例。


最新回复 (10)
  • riceawa 08-08 08:01
    1

    得看用的什么harness,我在codex里面用deepseekv4f max感觉前端还行但后端有点差,换成claude code又好很多了()


    luna max还是好一点的,毕竟有多模态,而且deepseek要涨价了,那luna可能是性价比最高的了(

  • 爱长草的云 08-08 08:03
    2

    是的,评测下来v4flash正式版开max接近于gpt5.5的能力,而luna max感觉只比5.4 mini强一些,但只是就编码能力而言,而luna有多模态这个能力也要考虑在内

  • Sam Altman 08-08 08:06
    3

    我就没见过任何一个模型在 codex 里的表现比在 Claude code 里要好的

  • igg8 08-08 08:06
    4

    但是快啊!前期做好规划,验证,审查,ds就很好用了

  • Ryan 楼主 08-08 08:09
    5

    可能跟用途有关,如果用于算法/量化的话,似乎模型的能力更重要些。


    我几种harness用下来,没感觉有啥区别

  • xiaoyaotan 08-08 08:11
    6

    我个人使用体验下来,这个luna 比不了DeepSeek,感觉模型能力差距不大,但是luna 速度太慢了,这个太致命了

  • 董炸淘 08-08 08:13
    7

    luna太慢了,能力和dsv4f感觉差不多

  • babu 08-08 08:39
    8

    luna的上下文长度不够长,貌似327K左右,相比之下flash原生支持1M,对话次数一多,就不在luna的能力区间了。

  • babu 08-08 08:40
    9

    或者说上下文不够用的话对于某些任务就是致命的问题,因为会频繁压缩上下文,丢失信息

  • Logos 08-08 08:41
    10

    佬友一个会话窗口是拉满1m的吗,会不会导致性能不稳定

* 帖子来源Linux.do
返回