Arena榜单:DeepSeek V4 Pro排名第10,峰谷时段价格翻倍

steve1996 2026-08-16 12:55 1

8 月 13 日,历经 4 个月打磨,DeepSeek 推出了 V4 Pro 正式版。昨天最新的 Arena 榜单结果正式出炉,V4 Pro 位列全球第十。




一、 双榜实测:DeepSeek 对齐 GLM-5.2,同等战力成本砍半





两张榜单结合来看,核心重点分为两点:


1. 性能对齐


在 Arena 前端开发榜上,DeepSeek V4 Pro 以 1584 分排名第十,与第九名的智谱 GLM-5.2(1585 分)仅差 1 分;在 Artificial Analysis 综合智能指数上,两者也同为 53 分并列,基座与代码能力几乎完全打平。


2. 价格领先


智谱 GLM-5.2 每百万 Token 为输入 8.00 元、输出 28.00 元;而 DeepSeek V4 Pro 闲时仅需输入 4.50 元、输出 13.50 元,哪怕在高峰期(输入 9.00 元、输出 27.00 元)也比对手便宜,闲时更是直接把调用成本腰斩了一半。




二、 体验升级:正式版的四个关键改进


对开发者来说,V4 Pro 正式版主要带来了四项实际改进:


1. 减少人工干预


具备状态闭环与自主纠错能力,明显改善了预览版“改一个文件就停下”的中途断流以及长流程指令漂移问题。


2. 复杂代码实测提升


DeepSWE 评分从 12.8 提升至 62.7,在真实 GitHub 仓库中定位缺陷、多文件联动并跑通单元测试的能力显著增强。


3. Token 消耗按需调控


开放 lowhighmax 三档思考强度,方便工程师根据任务难度调配推理深度,更好控制 Token 预算与延迟。


4. 兼容主流工具链


原生支持 Responses API 接口,可以直接接入 Codex、Claude Code 等开发环境,降低接入和适配成本,方便直接嵌入现有开发工作流。




三、 价格全景矩阵与账单测算


尽管 DeepSeek 对 V4 Pro 实施了定价调整,但拉出全景数据对比依然保持着巨大优势(每 1M Token 人民币):



  • DeepSeek V4 Pro(空闲时段):输入 4.50 元 / 输出 13.50 元

  • DeepSeek V4 Pro(高峰时段):输入 9.00 元 / 输出 27.00 元

  • 智谱 GLM-5.2:输入 8.00 元 / 输出 28.00 元

  • Claude Sonnet 5:输入 13.48 元 / 输出 67.40 元

  • GPT-5.6 Terra:输入 16.85 元 / 输出 101.10 元


从综合账单测算来看:



  1. 对比同梯队国产旗舰(GLM-5.2):V4 Pro 高峰期价格与 GLM-5.2 基本持平,而在空闲时段,调用成本仅为 GLM-5.2 的 50%;

  2. 对比海外中端旗舰(Sonnet 5 / Terra):即使在高峰期,V4 Pro 价格也仅为 Sonnet 5 的 44%、Terra 的 30%;空闲期更是低至其一到两成。




四、 商业透视:为何引入动态计费与 Harness?



表面是调价,深层折射出中美 AI 商业化造血飞轮的根本分化:


1. 海外双雄的吸金飞轮


OpenAI 凭借超 5000 万付费席位,年化收入(ARR)直奔 250 亿美元;Anthropic 凭借高阶 B 端企业客户(占比超 80%),ARR 达到 690 亿美元,光是 Claude Code 单品年化收入就达 25 亿美元,毛利率稳步冲向 77%。高客单价的企业订阅与生产力工具,直接构成了海外大模型最核心的造血来源。


2. 国内变现的阵痛


国内普遍是“先免费做大 DAU 再变现”的互联网打法。像豆包等产品每天承受着天量显存损耗,C 端订阅付费意愿极低,最终转向在电商、本地生活与酒旅业务中抽取佣金(如 12% 综合费率)来进行泛商业化变现。纯技术团队如果长期打亏本价格战、低价裸卖 Token,算力失血不可持续。


3. DeepSeek 的商业化应对



  • 第一,分时计费是按负载分摊成本:核心原因在于白天上班时间大家都在集中调用,高并发导致服务器承载压力极大、运营成本激增,因此高峰期(9元/27元)必须收取更高的费用;到了夜间下班后调用量大幅减少,价格才回落到 4.5元/13.5元。

  • 第二,推出开源框架 DeepSeek Harness:单纯靠低价卖 API 接口利润空间非常有限,通过开源 Agent 运行环境切入工具链底层,在企业私有化部署和定制化服务中寻找新的盈利增长点。




Arena 双盲评测大模型排行榜(镜像)

最新回复 (3)
  • emdel 08-16 13:00
    1

    ai文?

  • mzm 08-16 13:00
    2

    k3这些模型都比gpt强?

  • kshy233 08-16 13:18
    3

    @mzm #2 前端能力确实强

* 帖子来源NodeSeek
附近帖子
返回