deepseek话说什么时候能上多模态?

mantest 2026-08-05 21:36 1

最近用deepseek v4 flash用的真是异常的爽的,指哪打哪,速度还快,没有防御性编程,关键是用不完呀。只要不是涉及页面相关的调整,但是只要一涉及,我的天,基本是人肉提示词,做出来成品和参考图差异很大,最后被迫还是用GPT 5.6,一波就还原了80%,虽然很慢。


期间用了MCP去中转识图,但是效果还是很差。如果未来PRO正式版支持多模态,那真是的国产崛起的里程碑。有时真的千言万语,不如一张图来的快。

最新回复 (11)
  • 小杨同学 08-05 21:42
    1

    有生之年,估计,大概,应该,可能,会做吧^-^

  • sse 08-05 21:44
    2

    这种吗?


    并且上传了hf

  • Sycamore 08-05 21:44
    3

    opencode不是给你安排好了吗 mimo 2.5 两大管饱

  • 迪咖 08-05 21:44
    4

    梁总说过不做多模态,唯一的目标很明确,不搞分支

  • LKY 08-05 21:45
    5

    我现在用opencode go,正好里面mimo2.5也便宜,直接原汤化原食了,将就用用,感觉ds上的话应该也就现在的识图模式改改

  • Sakiko 08-05 21:45
    6

    按照梁文锋的意思,什么时候DS agi了,什么时候有多模态

  • Howie_H 08-05 21:50
    7

    是全部用2.5还说是混合来用,可以自动分流吗?

  • LKY 08-05 22:00
    8

    用的是这个mcp,上传图片后dsv4f会丢给接入了mimo2.5的mcp读图,然后返回.轻度使用也够用



    本帖使用社区开源推广,符合推广要求。我申明并遵循社区要求的以下内容:

    我的帖子已经打上 开源推广 标签: 是
    我的开源项目完整开源,无未开源部分: 是
    我的开源项目已链接认可 LINUX DO 社区: 是
    我帖子内的项目介绍,AI 生成、润色内容部分已截图发出: 是
    以上选择我承诺是永久有效的,接受社区和佬友监督: 是
    以下为项目介绍正文内容,AI 生成、润色内容已使用截图方式发出

    接上篇帖…
  • mantest 楼主 08-05 22:02
    9

    我看站里佬友有透漏内部消息,pro有可能支持多模态,值得期待一波

  • mantest 楼主 08-05 22:03
    10

    但是我感觉效果还是不太好,这样,相当于两个模型在配合工作。如果只是识图文字可以用,但是一遇到UI样式的,还是很拉,特别是动态特效更不用说了

  • lq-259 08-05 22:06
    11

    v4应该是不会有了,多模态岗位也在招人,估计得明年?

* 帖子来源Linux.do
返回