【分享喜悦+经验】解决了OpenCode deepseek识图问题

walker xie 2026-08-13 16:23 1

自从deepseek v4 flash除了之后,我天天用opencode,感觉模型能力很强,日常使用基本满足了我的所有需求,也就不再用cursor了(其实是cursor民间渠道涨价了)。美中不足的是ds 没有识图能力,很多时候我还得截图给网页版ai然后描述下情况,再粘贴到opencode,今天突发奇想问了问ai有没有插件可以同时接入两个模型,就是当识别到图片时,用多模态模型去识别,然后交给ds回答,没想到一问还真有。就是 opencode-image-vision这个(可能会被判定为开源推广,但这不是我开发的,所以就先不附github链接了),然后我让opencode 装上这个插件,发现挺好用的,解决了一大不变。分享出来,看看有没有遇到同样问题的佬。

最新回复 (13)
  • Rejector 08-13 16:25
    1

    opencode 不能配置识图子代理嘛,还得另外找个项目来支撑。我这边用kimicode配一下就行,ds需要识图就会自己拉子代理。

  • walker xie 楼主 08-13 16:27
    2

    opencode 不能配置识图子代理嘛



    啊 ,好像可以配置子代理,但是至于怎么用,我研究下。代理 | OpenCode

  • Rejector 08-13 16:29
    3

    其实吧,需要什么之前不用自己想要怎么用,而是贴文档让code自己配就好了。

  • 亚斯娜 08-13 16:32
    4

    你们识图的场景是什么,如果是还原设计稿,外接的识图不好用吧

  • walker xie 楼主 08-13 16:33
    5

    试了下@explore 这个子代理,大概懂了,是派一个代理去执行某些任务,这样配一个识图模型作为子代理识图,然后再用主代理分析也可以,不过感觉不如直接用插件直接。

  • walker xie 楼主 08-13 16:34
    6

    比如软件某个地方不好看,可以直接截图让优化。这个外接识图其实就是让配置的AI识别描述图片,至于识别效果,更多的取决于配置的模型。

  • yydxx 08-13 16:34
    7

    我是直接魔改CPA,加了视觉回退,配置好以后会自己调多模态模型识图然后把内容再传回去



    使用效果:





    原图:



    识图:



  • Rejector 08-13 16:36
    8

    是的,主要就是附属一个多模态子代理,比如:k2.7、k3 就非常好用而且细节到位。

  • walker xie 楼主 08-13 16:36
    9

    我选择opencode go 的mimo v2.5,主要是便宜 ^-^

  • Rejector 08-13 16:38
    10


    单识图消耗不大的,昨天一天我也就200多万。

  • 硬弟安人 08-13 16:44
    11

    现在插件商店直接能下载了有个外接视觉的插件,也是调用别的多模态模型进行外接

  • MorningBOBO 08-13 17:03
    12

    我也是opencode deepseek用,我是在codex上用,然后配置的是MCP对接另外的模型去识图,还有在codex里面更好的方法么。感觉现在这个,虽然写规则了,有时候还是得提示他去用。。。有点难用。

  • 马凌曙 08-13 17:07
    13

    QwenLM/Qwen-MM-Plugins: Make any agent harness multimodal-native.Qwen新出的,没试过这个

* 帖子来源Linux.do
返回