DeepSeek有多模态API了!!

Mumu 2026-08-21 17:55 1

见官方公众号。


文档也更新了。

最新回复 (12)
  • EastJoe 08-21 17:56
    1

    不是哥们,这才过去20天,这么快就训练好了?

  • yu1745 08-21 17:57
    2

    有没有可能官网已经开放识图了3个月了

  • 凡尘 08-21 17:58
    3

    今天上午看到这位佬的帖子,下午就真出多模态api了



    DeepSeek Harness 的源码出现了 deepseek-v4-flash-vision-exp。

    [初步简要分析]
  • 温州程序员劝退师 08-21 17:59
    4

    连夜把 ds-v4-vison-exp 接入视觉测试

  • wangzhen3691 08-21 18:03
    5

    真的假的,不会是又外接了个小模型做ocr吧

  • microsoft2333 08-21 18:03
    6

    这个效果嘛,不怎么样啊感觉

  • calendar 08-21 18:03
    7

    感觉这是知识库的问题?网页端也识别不出来

  • randname 08-21 18:04
    8

    只是没有数据而已,拿这方面测没啥意义

  • flymyd 08-21 18:07
    9

    Gemini 3.7 Flash / GPT5.6(Luna/Sol) / Grok 4.6都挂了,就豆包过了,鉴定为豆包>Sol

  • Tsingten Hsu 08-21 18:08
    10

    很早就想吐槽了,测试视觉怎么用识人题,不应该看它的前端参考开发能力么。

  • Mozi 08-21 18:14
    11

    测这个题目又没毛病,测试人的题目就是测世界知识

  • Doro2077 08-21 18:59
    12


    能识别

* 帖子来源Linux.do
返回