DeepSeek多模态来了!!

桑榆 2026-08-21 17:32 1

官方确认:deepseek-v4-flash-vision-exp 模型发布!


1.官方群发布



2.公众号官文链接:https://mp.weixin.qq.com/s/UGMfvPMwBIB4oFYZZejekA


3.能力测评:多模态 Agent 能力已接近 Opus-4.8



4.官方文档更新



5.图像理解文档:图像理解 | DeepSeek API Docs



6.官推



7.API 支持


用户可以通过设置 model=‘deepseek-v4-flash-vision-exp’ 来访问 V4-Flash-Vision-Exp 模型的 API。在 API 服务中,图片会转换成 token 后按 token 计费,一张图片最多占 384 tokens,计费价格与 V4-Flash 模型一致。


多模态 API 支持:



  • Chat Completions、Messages、Responses 三种格式调用,可以方便接入各类 Agent 工具中使用,支持图文混合输入,支持 base64 内联、外部 URL、Files API 三种图片传入方式。

  • 使用说明请参考官方 API 文档:API 指南 - 图像理解(Your First API Call | DeepSeek API Docs


8.Files API 上线


Files API 现已开放,该 API 不收费,用户可先将图片上传到平台,再在请求中通过 file_id 引用,从而节省请求带宽。同一张图片在多个请求中无需重复上传。


详细使用说明请参考官方 API 文档:API 指南 - Files API(Your First API Call | DeepSeek API Docs


9.定价:与v4 flash一致。


最新回复 (12)
  • Morli 08-21 17:33
    1

    原生多模态吗,阔以阔以 终于有眼睛了

  • Fireworks 08-21 17:34
    2

    相当期待,官方发布时间是啥时候哦

  • 桑榆 楼主 08-21 17:35
    3

    官方发布时间



    已经发布了的,现在API可以调用使用了。

  • flymeng 08-21 17:38
    4

    看benchmark,除了加了眼镜,这智力也上升了?

  • muzi 08-21 17:39
    5

    要不把这个当成pro进行发版吧 ^-^

  • 桑榆 楼主 08-21 17:43
    6

    这智力也上升了?



    官方测试的能力:多模态 Agent 能力已接近 Opus-4.8,综合相比v4 flash是有提升的。

  • 08-21 17:43
    7

    虽然多模态来了

    但是小南梁也涨价了啊

    能不能回到之前的价格啊!!! ^-^

  • 桑榆 楼主 08-21 17:44
    8

    原生多模态吗,阔以阔以 终于有眼睛了



    是多模态,鲸鱼^-^这次睁开了双眼,能力进一步提升。

  • shawpoo 08-21 17:46
    9

    你就来当pro吧,至于真正的pro,我们不熟

  • PlayGenshin 08-21 17:51
    10

    那只能看超节点950给不给力了。


    其实我感觉骂华子也没啥用,因为现在这种情况是底层的生产数量不够连带着上级的产量受限。只能看先进光刻机啥时候能大规模量产且部署数上去吧。

  • RICK 08-21 17:58
    11

    这个多模态从本质来说,跟原生多模态的模型还是差别,还是老套路,装上一个视觉编码器来理解,本质上还是把图片切割成块转换成token来理解,跟在DeepSeek harness上,装一个图片识别差不多?差距可能是这个视觉编码器更优秀..

  • 桑榆 楼主 08-21 19:10
    12

    硬件的发展同样重要,软硬协同,希望都能进步吧

* 帖子来源Linux.do
返回