DeepSeek v4.1一不小心就斩杀 glm 5.3 Flash,而被寄予厚望的 mimo x pro 多模态拉完了。

Tokoyami 2026-09-10 17:25 1

大肥鱼这个模型我觉得称为 DeepSeek 4.5 都不为过,正式上线多模态,我给了一个 SVG 复刻图片的任务,完成度很高。


这是大肥鱼 4.1 的版本:




这是我今天上午获得内测资格的 mimo x pro preview:




这是原图,image 2.5 生成:


最新回复 (12)
  • Ylulu 09-10 17:26
    1

    是同一个harness实现的吗,那小米真的任重道远了

  • 竭泽之鱼 09-10 17:27
    2

    这么强的吗?难道梁圣又回归了?不过mimo也真菜

  • feelfree 09-10 17:29
    3

    svg能做到这种程序已经很厉害了,希望尽早看到deepseek的文生图能力上线

  • RerrentLinden 09-10 17:31
    4

    v4.1 的这种 svg 真的说不上是大模型“画”出来的吧,

    应该是调工具把图片直接处理了,

    并没有真的运用到模型的多模态能力




    就跟 astra 刚发布那几天,很火的把照片转到画图上类似

  • 猫南北 09-10 17:37
    5

    应该不是吧,MIMO新版本目前只能在他家那个desktop里用

  • Tokoyami 楼主 09-10 17:45
    6

    mimo 的桌面端和 codex 简直一毛一样,前端完全抄袭,后端用的是 opencode。

  • 猫南北 09-10 17:45
    7

    后端不是他们fork的那个mimocode么?

  • Tokoyami 楼主 09-10 17:45
    8

    确实是这样的,我刚刚看了,DeepSeek 确实是用了 Python pipline 处理了图像色彩

  • Tokoyami 楼主 09-10 17:53
    9

    是的,但和 opencode 区别不大,而且我实测harness很拉,因为时不时就会工具调用出错或者权限不足。 这是我用逆向mimo desktop 查看的实际结果。里面还有一个自进化 agent 体系,雷总小巧思这一块

  • Nanami_Chiaki 09-10 17:53
    10

    这个应该就是把图像切成多个小块然后临摹了,而我们说的鹈鹕骑车之类的都是理解图像内容→创作。

  • linux_dododo 09-10 18:00
    11

    u1s1,真要用svg实现这种图片,太不现实了

  • Redwind 09-10 18:01
    12

    发帖之前还是先看下轨迹再给结论吧。。。。

* 帖子来源Linux.do
返回