DeepSeek V4 Pro正式版来了!尚未公布调价方案

gaoxiangyang 2026-08-13 08:15 1



从目前官方公布的信息来看,DeepSeek V4 Pro支持1M上下文长度,最大输出长度达到384K Token,同时支持非思考模式和思考模式,其中思考模式默认开启。


根据DeepSeek官方公布的评测结果,DeepSeek V4 Pro正式版模型在HLE、Terminal Bench、Cybergym、DeepSWE等Agent能力超过Anthropic的Claude Opus 4.8,逼近Anthropic 6月发布的模型Fable 5,甚至有些榜单实现反超。

最新回复 (19)
  • FFFFFFFFFir 08-13 08:19
    1

    有点不懂这些榜单benchmark具体针对的任务类型,像mc游戏mod的应该算java后端吧,这应该看哪个benchmark呢

  • jolyne 08-13 08:20
    2

    (帖子已被作者删除)

  • GloryDuck 08-13 08:20
    3

    简单来说 Deep swe 是最有价值的。代表的是能够长程处理一个复杂项目的能力

  • yxbj 08-13 08:22
    4

    这和榜单有关系么?什么叫以前是接近现在是超越

    这个模型以前什么时候有过接近的评分

    今天刚出来的啊

    今天第一次评分,请问他接近的评分是什么时候评的?

  • jolyne 08-13 08:24
    5

    (帖子已被作者删除)

  • junhua 08-13 08:33
    6

    这么牛逼吗,这么看flash还是很值的

  • yxbj 08-13 08:36
    7

    这里讲的就是两个模型

    一个flash一个pro

    你说的不是pro,那说的flash喽?


    图上那个flash的参数超过了?

  • yxbj 08-13 08:45
    9

    你原话是“感觉榜单越来越离谱了,以前还是接近现在直接是超越了”

    我一个字没增没减


    请问你所说的“例如以前 qwen 之类的,或者百度的模型”

    在哪里?

  • 牗空 08-13 08:53
    12

    嘿嘿嘿,哥们儿,话里带刺的是你,别倒打一耙^-^,这里不是抖海,不兴你急了这一套,反手炼化

  • yxbj 08-13 09:01
    13

    我回复的是你发的第一个回复“感觉榜单越来越离谱了,以前还是接近现在直接是超越了”


    这个回复提到qwen或者百度的模型了么?


    你到刚才才回复引用你真正要回复的内容,请问别人怎么知道?


    大模型对话至少也要有上下文吧?

  • gaoxiangyang 楼主 08-13 09:01
    14

    各位别争论了,都没有恶意,都冷静冷静,不要么这激动嘛!不就是新模型发布了吗,新品发布,总会带些夸大的宣传,雷布斯连个五菱上的门把手都能吹上几分钟,没必要这么较真了,好用不好用,自己测试测试就行了。

  • kiki 08-13 09:03
    15

    官方都没有发布吧?现在都是自媒体带节奏。

  • jolyne 08-13 09:06
    16

    (帖子已被作者删除)

  • gaoxiangyang 楼主 08-13 09:07
    17

    也不全是自媒体了,新浪,百度,还有it之家这些媒体上都报道了,感觉官宣也不远了

  • 江雪何年初映人 08-13 09:11
    18

    人家的意思是从以前的其它模型一直到现在,你理解错了。而且榜单这东西不都是图一乐吗,真正上手有效果才是最重要的

  • yxbj 08-13 09:13
    19

    这话没问题啊,他要是这么说。没人会反对


    他这话的主语是啥你再看看

  • saberNighr 08-13 09:14
    20

    v4 pro开源吗?如果开源的话,梁圣我每天睡觉前给你供个神像拜一拜

  • 觉浅 08-13 09:25
    21

    效果有些差强人意了,感觉其实是灰度,不然官网怎么只改文案不发文,公众号也不发

  • yxbj 08-13 09:29
    22

    我说的很清楚,我回复的是他的第一句回复“感觉榜单越来越离谱了,以前还是接近现在直接是超越了”


    这句话没有任何其他引用,我认为他的意图是指榜单造假,所以我反问了一下。


    他后来的解释是,他说的不是deepseek,说的是qwen,baidu。问题是他前面的话根本没提到这两个模型,别人怎么知道?


    你要说我语气有问题,可以,没问题


    那请问他回复我的“你自己没有手吗,不知道搜一下?”这句话带不带刺啊。该不该炼化啊?

* 帖子来源Linux.do
返回