Mimo 2.6 Flash 是否智力太低....

Banned4k 2026-09-22 18:34 1



OpenCode免费给的Flash.

OpenCode加了一个Fastctx.

MIMO它自己开了个子代理,每一个关键词都狂搜, 直接狂搜三百次, 直接把上下文橄榄死循环了 ^-^


老老实实花钱用DS Flash 4.1了现在

最新回复 (7)
  • 菜鸡rrr 09-22 18:36
    1

    死循环好像是因为有点训练刷点刷的过拟合了,之前qwen有几个模型特别容易出现,不过qwen都是小参数的模型会这样

  • Oaki Doki 09-22 18:43
    2

    2.6 flash 没有测试这个,但是2.6 pro发现了在pi里工具10连发导致输出截断然后失败。感觉也是训练时惩罚低效率的原因。但是mimo token plan不错,没有5小时/周限,可以做很好地补充。


    可是mimo 2.6系列说话依然很自然,没有为了token效率变成caveman,我真的太讨厌caveman和 grok的输出风格了。属于牺牲了沟通能力,错误的优化token效率。


    其实我在Hermes里因为一些系统提示词,我见过gpt的思考,gpt的思考也是自然的语言,不是碎片。


    同时只是一般雷霆大思考,不是ds的超雷霆大思考。


    Glm 5.3 在pi里有时也会思考过长被截断,在不用调用太多工具的时候。调工具就能重新计算长度了,多一次缓存读取的差别。


    总体来说感觉 2.6 pro,ds v4pro, glm 5.3, kimi 2.8 preview 是差不多的模型,但因为订阅的原因5.3 我用的最多,感觉代码似乎有时可以,有时经常给出错误的推断和过度设计的方案

  • myspeedon 09-22 18:45
    3

    2.6 flash 没有测试这个,但是2.6 pro发现了在pi里工具10连发导致输出截断然后失败。感觉也是训练时的提效的原因。但是mimo token plan不错,没有5小时/周限,可以做很好地补充。



    tool-call flooding cancels entire parallel tool batches; UI mislabels as read/search/command failure and models retry-loop · Issue #2475 · XiaomiMiMo/MiMo-Code · GitHub 这个问题

  • Oaki Doki 09-22 18:48
    4

    哇原来已经有issue了,我是在pi里遇到的,而且模型自己发现了问题,跟我说接下来一次一个工具调用 (另一个极端^-^)

  • Xushengfeng 09-22 18:50
    5

    死循环老问题了

    以前如果提示词有排比或者重复思考经常就雷霆重复思考循环

    只能说正版了^-^

  • forgives 09-22 18:51
    6

    实测的确一般,虽然看分挺高的,但不接地气,不好用。

  • lseraph 09-22 19:45
    7

    看起来实用方面还是不行啊,光刷分了

* 帖子来源Linux.do
返回