
大家好,我是吃太饱骑士。 微信公众号同名同号,对 AI 科研和 AI 杂谈感兴趣的话可以关注我哦。
最近这两天 AI 圈有关价格的八卦真不少,瓜是真的让我吃到饱。
我也是迫不及待想给大家分享。
DeepSeek V4 Flash 正式发布
当初梁叔叔说DeepSeek V4 会在 7 月中旬发布,大家都翘首以盼。
结果梁叔叔重新定义了“中旬” 差点来了一出《梁宫春日的忧郁:漫无止境的七月》。好在 Flash 的正式版在 7 月 31 日姗姗来迟。

正式版这次重点强化了 Agent、代码生成和工具调用能力。
eepSeek V4 Flash 的总参数规模约为 284B,放在今天的模型阵营里并不算特别夸张。但从官方测评来看,它却可以和其他参数大得多的模型掰掰手腕。这是直接拿起”跨境界斗法“的爽文主角剧本。
但真正让全网敲锣打鼓的不是他的跑分,而是他的性价比。
V4 Flash 的普通输入价格为每百万 Token 1 人民币,输出为 2 人民币;缓存命中后的输入价格还要更低。
这个定价已经很难只用“便宜”来形容。就以我的昨天的测试结果来看,


我用了 3 千万 Tokens,但花费仅仅是 1.61 元。仅仅是这个数据摆上来,我相信已经无需再多言。
更有意思的是,本次 DeepSeek 对 codex、claude code 等工具都做了适配优化,缓存率大大提高。社区反馈缓存率从更新前的80%——90%直接飙到了95%甚至 99%。这也是为什么我用了 3 千万 Tokens,却仅仅花费 1.61 元的原因。
虽然这还是没法和GPT订阅相比,但API原价能达到这个程度真的很夸张了。
而梁圣的这招”拖刀计“,不但震撼了等待近半个月的社区,也正巧打了其他两家大模型公司措手不及。谁呢?
GLM 订阅计划改制
7 月 30 日,GLM Coding Plan 调整了订阅规则。

一句话概括:实际上就是从 Coding Plan 变为了 Token Plan 。
Token Plan:“按实际消耗的 Token 计费”,用多少算多少;Coding Plan :理解为“按请求次数计费”,一次对话或调用算一次,不太区分内容长短。这是社区约定俗成的定义,我这里也是简单借用。实际上作为产品名,提供方想怎么起名就怎么起名。
从技术和成本角度看,这种调整并不难理解。
在普通聊天阶段,一次请求与另一次请求之间的成本差距可能还比较有限。但到了 Agent 和 AI 编程阶段,有的请求只是解释一段代码,有的请求却要读取整个项目、连续调用工具,并进行多轮修改。
用 Token Plan 来取代 Coding Plan 在目前全世界算力紧张的大背景下其实是可以理解的。
但智谱这次的定价让几乎所有 C 端用户都大跌眼镜(这在我之前的帖子里进行了详细的分析,这里就不详述了)。简单来说就是,价格涨,用量也涨,但性价比降低了。总之,在许多社区中,智谱都凭借这波操作赢得了”Z/“的美名,当然也包括咱们 L站。
更不巧的是,智谱撞上了 DeepSeek V4 Flash 发布。如果诸位仔细看过刚刚的 DeepSeek 的分数榜单的话,就会发现 744B 的 GLM 5.2 被 284B 的 DeepSeek V4 Flash 反超了。
而且更更不巧的是,目前各家旗舰国模里,只有 GLM 5.2 不是多模态大模型。
DeepSeek V4 Flash 与 GLM 5.2 同属非多模态大模型,无法处理图片、音频等信息。这导致它们俩是直接竞争对手。而其他国模还能够凭借多模态的特点在很多场景下逃过 DeepSeek V4 Flash 的性价比斩杀线。
而两者的 API 的输入 Token 价格差是8倍。
只能说这次智谱对用户不够”走心“,也不够走运。那市场是否还会为其”走个面“呢?
也许需要等智谱的下一代模型了。
GPT-5.6 降价
同样是在 7 月 30 日,OpenAI 宣布下调 GPT-5.6 部分模型的 API 价格。

其中,GPT-5.6 Luna 的输入和输出价格均下降了 80%。输入从每百万 Token 1 美元降至 0.2 美元(折合约 1.3 人民币),输出从 6 美元降至 1.2 美元(折合约 8.04 人民币)。
GPT-5.6 Terra 的价格则下降了约 20%。
旗舰型号 Sol 没有直接降价,但新增了速度更快、价格也更高的 Fast 模式。
这次调整最值得关注的是 Luna。降价之后,它进入了一个非常有竞争力的价格区间。
OpenAI 给出的解释是,GPU 内核优化和推测解码等技术改进降低了推理成本。换句话说,这并不只是一次短期促销,而是模型服务效率提高以后,对价格体系进行的重新调整。
消息公布以后,GPT-5.6 Luna 很快被一些开发者视为新的性价比选手。从社区反馈来看,思考强度为 max 的 GPT-5.6 Luna,在处理各类轻量的编程、Agent任务上都有不错的表现。
那一刻,它似乎重新坐上了价格与能力平衡的王座。
但还是那句话:第二天,DeepSeek V4 Flash 正式版发布了。
Luna 的输入价格是每百万 Token 0.2 美元,V4 Flash 是 0.14 美元;Luna 的输出价格是 1.2 美元,V4 Flash 则是 0.28 美元。虽然从跑分来看,Luna 的性能还是略胜 V4 Flash 的。
但如果只讨论“性价比”这个王座,GPT-5.6 Luna 这次大约只坐了半天。
DeepSeek 作为一条蓝色大鲸鱼,像鲶鱼一样横冲直撞地捣乱了整个 AI 市场。
这就是我爱 DeepSeek 的原因。爱死你了,蓝色大鲸鱼!
不过值得注意的是,订阅 GPT 计划后使用 Luna 还是比 V4 Flash 官方 API 要省得多。毕竟API定价和订阅计划本来就有天然的差距。OPENCODE GO的订阅的 V4 FLASH倒是很坚挺,不过我也没做过正式的计算,看有没有佬友计算出来了。
TRAE 中国改为积分制
最后一条八卦,也是最让我唏嘘的。
我曾经是 Trae 的忠实用户,在国际版还是按次计费的时候。那时候 Trae 里还是 Claude 4 Sonnet 、GPT 5.4 等最新大模型。

这是我开始写代码后最好的一个夏天。
那时候 TRAE 里还有 Sonnet 和 5.4,额度多得像用不完。我刚想到一个需求,就敢直接让模型重构整个项目;报错了不用自己查,继续问;结果不满意,也不用精打细算,直接开新对话再来一遍。
写一周代码,消耗的额度还没有数字焦虑增长得快。每天打开 TRAE,都能在 Sonnet 和 5.4 之间随便切换,仿佛顶级模型本来就应该像水和电一样,永远在那里。
我说,那一刻让人产生了‘人类正处在黄金时代’的错觉。
可后来先是 Claude 从 Trae 下线,我理解,毕竟 A/ 排华。
然后是 TRAE 国际版改为积分制。我也理解,毕竟按次付费我可以把字节薅秃(不是)。
最后是模型不再更新。我已经不再在乎,因为我很少再使用 TRAE 了。
但我购买的年费 Pro 会员一直在。虽然每个月没用,但我也没去退款。也算一种“报答”?毕竟我开始 Vibe coding 和 Vibe Reseach 的每个最初的脚印都有 TRAE 的痕迹。

最近,TRAE 的中国版也改为了积分制。

这在 TRAE 的用户社区里掀起了轩然大波。

其中具体的是非功过,其实没啥好讨论的。积分制是大势所趋。没有公司能做到一直“大撒币”。TRAE 总有一个时刻会结束免费使用、付费加速的模式。毕竟国际版早就打了样。
其实我们都知道,“按次付费”的时代结束了。以 KIMI K3为起点,国模的性能直逼国际最先进的模型,国模的价格也不可能再想从前一样“低廉”。
## 最后
AI 一直在烧钱,不烧公司的,就烧投资者的。不烧投资者的,也得烧用户的。在经济学规律下,无非是谁买单的问题。
但谁都没想到吧!价格的尾巴还有我们梁叔叔拖着!

如果真的物有所值,用户赶也赶不走。你觉得呢?
我是聊闲天的吃太饱骑士,一个混迹 AI 和科研圈的有趣灵魂。欢迎佬友关注、聊天!