文本模型怎么才能支持识图

云从 2026-06-22 19:43 1

让纯文本模型支持识别图片和生图,和生成图片,从API源头上开始,文本模型deepseek-v4+qwen3.7 plus+gpt-imag2,把多个模型合并成一个新的多模态模型,然后使用直接调用这个模型,有什么项目可以实现这个吗

最新回复 (3)
  • 大大怪将军 06-22 20:20
    1

    缓存呢 你不如 搞一个skill 识图去调用agent qwen ,生图调用 gpt image agent

    主模型使用 deepseek

  • xx_yy1 06-22 21:47
    2

    让你AI给你写一个MCP,这个是最合适的,因为它是上下文交互

  • Suhuanzhen 06-22 22:37
    3

    站里有位佬的 1flowbase项目。挺好用

* 帖子来源Linux.do
返回