公允地评估deepseek v4 flash的性价比

欣 郁 2026-08-03 12:47 1

DeepSeek v4 flash ga发布后,仍然有人在叫嚣gpt-5.6-luna具有价格优势,可以“斩杀”多数国模(注:不是本人 ^-^ ),为正人心、靖浮言,特此计算。


结论:deepseek-v4-flash-0731(以下简称dsf)比gpt-5.6luna(以下简称5.6-luna)更有优势。


具体而言:


低用量走api:dsf能力略逊,但价格完爆5.6luna。


高用量走订阅:dsf能力稍强,价格比5.6luna略便宜。




我们只考察具体场景下,各自最便宜的、来源渠道稳定且正规的方案。


低用量情况下,二者都走官方api。dsf能力稍弱,单次输出短,不支持多模态;二者decoding速度相当;但是dsf价格比luna便宜了6倍左右(计算见附注一)。


高用量情况下,dsf可以走opencode订阅,luna走openai订阅。



  • 正规的opencode为每月10美元(不考虑“无限白嫖首月优惠”的情况),等效额度60美元,既可以认为将api价格降低6倍

  • 正规的gpt plus为每月20美元,等效额度320美元(不考虑tibo的重置),既可以认为将api价格降低16倍


则都拉满订阅的情况下,dsf价格大概是luna的44%。但注意:


1)codex来源的luna仅支持200k+上下文,且速度比api慢(很多人缝合了“api的上下文+速度优势”以及“codex订阅的价格优势”),所以dsf具有性能优势;


2)如果订阅无法拉满,则dsf的价格优势更大。




附注一:


API官方价格,输入无缓/输入有缓/输出:


dsf:1/0.02/2rmb


5.6luna:0.2/0.02/1.2​^-^=1.4/0.14/8.4rmb


参考openrouter的计算(附注二),加权输入价格(即合并有缓+无缓),输入/输出价格:


dsf:0.032/2rmb


5.6-luna:0.57/8.4rmb


假设每次任务输入占比为a,a在[0, 1]


则dsf价格为:0.032a+2-2a=2-1.968a


5.6-luna价格为:0.57a+8.4-8.4a=8.4-7.83a


a即输入占比通常在90%-95%,则api token价格,5.6-luna是deepseek v4 flash的5.9-7.3倍


附注二:openrouter的加权input计算方式


最新回复 (11)
  • zhengshsh 08-03 13:04
    1

    很多人是中转站用多了,以中转站的视角进行衡量了,中转一般 0.15 倍率,加上等比充值,算下来会便宜特别多

  • 钟阮 08-03 13:07
    2

    DS有海外价格,变量都不统一,大部分中转站做下来的GPT其实0.2:1(单看汇率大于1:1的),建议统一为美元定价

  • 👽 08-03 13:08
    3

    大家的opencodego订阅都是在cc中用吗?

  • dibin 08-03 13:10
    4

    (帖子已被作者删除)

  • wjy 08-03 13:12
    5

    如果算ChatGPTpro20x呢,还要考虑Pro20x附带一个独立额度的web

  • Kassdin 08-03 13:15
    6

    pro20x 200 刀都付了还用什么 luna,一直用 sol 就行了,20 刀买的 plus 的 luna 都用不完。

    ds 的优势在于买到充足的用量只需要 5 刀

  • 王锄地 08-03 13:16
    7

    楼主不是都算了订阅价格吗?怎么楼上还一堆人说中转站倍率?

  • 金陵雪 08-03 13:17
    8

    这比的就不合理,20x的成本是多少,有这个钱还用flash和luna吗

  • luoxiaoxin 08-03 13:17
    9

    一句话秒杀,用中转站,目前基本在0.1倍左右,并且人民币兑美元1:1。

    其实比较luna和v4f完全没有意义,luna和v4f的使用场景就不一样,luna有多模态,v4f有长上下文,自己看自己需求来,没必要比较。

  • wjy 08-03 13:19
    10

    你硬算成本那看看中转站的成本呢?


    中转站pro池0.35的倍率下,gpt5.6luna就是比flash订阅便宜啊

  • xiaomao 08-03 13:20
    11

    你们做项目不做真实e2e的吗?困惑

* 帖子来源Linux.do
返回