GPT-5.6-Luna与DeepSeek V4 Flash到底用哪个?

WizisCool 2026-08-06 21:48 1

自从OpenAI将Luna模型价格下调80%,成功与DSv4Flash坐在一桌

但是在日常使用中,该选择哪个模型呢?



数据来源:Artificial Analysis 排行榜



























模型 综合得分 编码得分 Agentic 得分
GPT-5.6 Luna (max) 51.2 71.4 45.6
DeepSeek V4 Flash 0731 (Max) 49.9 69.1 45.7

两个模型从LLM排行榜跑分来看几乎无明显差距;

虽然Luna支持多模态是个优势,但是在Hermes中可以使用内置的多模型配置把图像识别任务交由其他模型,虽不比原生多模态,但是还算可用。


Flash给人的体感确实更快,但是我查看数据库后发现其实在hermes中Flash和Luna的单条消息推进速度其实是差不多的


(Flash 2.68 分钟/条 vs Luna 2.61 分钟/条)


这里主要的原因可能是Flash不隐藏思考链,而Luna只给出当前进行任务的摘要 (展示思考链也会导致感觉Flash思考的很笨 ^-^ 不过优势是可以及时引导模型)


Flash的逻辑发散能力明显不如Luna,当面对复杂问题时经常陷入反复无限推理当中,而Luna在复杂任务的表现上明显更优秀,对于拿不准的问题时会主动跳出思考进行询问或者联网搜索而不是乱猜,这种能力在Flash身上很少看到;我觉得不只是DS,很多国模都有这个问题


不过Flash在面对简单日常问题/重复性高的小问题上解决的很快,如果你的提示词明确,任务清晰Flash作为执行者表现感觉比Luna更好。


Flash很喜欢在面对不确定问题时直接开干,而不是先询问用户,这可能是提示词工程的问题也可以通过一些skill和agent来解决,但是在hermes中Flash经常直接开始乱做;

比如SKILL已经明确指导获取某个数据的脚本了,Flash看完之后依然觉得直接读取数据库更快然后开始直接操作数据库,Luna几乎不会出现这种情况。

最新回复 (17)
  • youccv 08-06 21:49
    1

    gpt luna 实在是太慢了,如果不是急活可以慢慢用

  • WizisCool 楼主 08-06 21:51
    2

    在我的日常使用中其实速度差不多

    Luna ~40.0 t/s

    Flash ~50.0 t/s

    只不过Flash会展示思考链看起来是要快一些。

    对于单条消息的平均推进时间都在2-3分钟左右

  • 超微蓝胖 08-06 21:52
    3

    都用啊,这两个小辣机得互相监督着玩

  • sittiu 08-06 21:53
    4

    Luna

    当然是,它知道自己在做啥

  • Guardinary 08-06 21:54
    5

    deepseek 马上就要涨价来着,以后可能还是 luna 性价比高吧

  • WizisCool 楼主 08-06 21:54
    6

    确实,但是Luna在审查Flash的对话时经常指出问题 ^-^,反过来Flash只会对对对

  • ryuki 08-06 21:55
    7

    我都是哪个便宜用哪个,flash快一点就是了

  • 远坂凛的宠物 08-06 21:55
    8

    luna有种高智商傻子的感觉,让他对着用例表测试,别忘了写日志,它真的没开个纯记录哪些做了哪些没做的用例表,也没写现有用例表,只开了个纯时间顺序增量日志。每次开始测试都把全部日志都读一遍才知道有哪些case没做。我一开始没当回事,后来测试越来越慢,对着文档文件夹一看人都傻了 还有老生常谈的不说人话问题。


    dsf真的聪明多了,遇到问题像个人,知道变通。也会沟通,会写文书。

  • Sam Altman 08-06 21:55
    9

    你这个 dsf 怎么这么慢,我官方 api 都是 100+的 tps 啊

  • 超微蓝胖 08-06 21:56
    10

    以我的经验,GPT会更顾大局,抓大放小,让ds去抓毛病也会抓出GPT认同的点

  • WizisCool 楼主 08-06 21:58
    11

    OpenCode Go的Flash

  • sse 08-06 21:59
    12



    • luna 打野/逆向

    • luna free号池

    • luna 官api/openrouter

    • flash 官api/openrouter

    • flash opencode go/第三方订阅

    • flash 打野/逆向






    0
    投票人



  • WizisCool 楼主 08-06 22:01
    13

    我的场景是在hermes中同一个任务分别让他俩去做,然后

    Luna去看Flash的Session,经常指出Flash的一些措辞和其他问题(虽然Luna也不怎么会说人话)

    Flash看Luna 的Session经常说没问题,可能是GPT的回复引导性更强吧

  • Jayce 08-06 22:05
    14

    非要选一个的话选flash,指哪打哪,速度非常快。

    都这个等级的模型呢,就不用做太复杂的事情,速度快是最大优势,而且渠道多


    luna也用了,正版的,说实话,一般,为了省那个成本。我感觉不是很划算,要做复杂的就直接sol,快的v4 flash


    插个题外话,luna被很多中转站都禁用了^-^

  • 天则则 08-06 22:07
    15

    Luna 便宜,速度快,但是需要买套餐才便宜

  • jqtmviyu 08-06 22:44
    16

    Flash很喜欢在面对不确定问题时直接开干 ==> 真实体验, 猛猛干


    luna 支持多模态, 能识别图片还原前端设计稿, 虽然速度慢.

  • HLiny 08-06 22:46
    17

    luna比DS 便宜,除非你有一些 DS 的特殊渠道。你的任务都能完成的话,哪便宜用哪个

* 帖子来源Linux.do
返回