分享一下这两天使用mimo-v2.5-pro-ultraspeed的感受

THEATLAS 2026-06-12 16:15 1

按照站里的教程申请了权限昨天通过了,给军儿充值了50体验一下api。接入codex进行开发,内容是llm相关的实验代码。



第一个感觉就是非常快,大概比5.5的fast还要快,当然钱烧的也飞快。粗略算一下成本大概一块五给1M tokens;其实不算很贵了,但是就是因为真的太快了,一个回合一下子就完成了,因此不知不觉就做了更多。



性能上来说感觉跟mimo-v2.5-pro没啥差别,做一些简单的根据计划重构和修改代码完全胜任。一些创造性的开发和测试目前也没有遇到完全不能用的情况,感觉智能水平接近5.4?(任务比较简单测不出来)


就是希望有成本更低的量大管饱的方案,现在主力用200刀的codex时不时就重置感觉真的太便宜的了

最新回复 (7)
  • alan_wang 06-12 16:55
    1

    我是没太理解,这种高速模型为什么不下放 Token plan。


    单位时间内速度更快了,能充分利用现有设备资源,也没用什么额外的设备,只不过是量化后的模型+新框架而已。

  • THEATLAS 楼主 06-12 18:20
    2

    我感觉因为现在可能还是在内测阶段,如果没有批量部署 Token Plan 的话,算力规模可能不太够。

  • Chisa 06-12 18:21
    3

    现在还不稳定,我烧了100块钱的,经常报错。目前属于体验阶段,还不能投入生产

  • 路人A 06-12 18:22
    4

    成本高,没有算力能部属,隔壁GLM5.1比Mimo还早出,至今仍只开放给企业用户

  • lueluelue 06-12 18:30
    5

    性能上来说感觉跟mimo-v2.5-pro没啥差别



    这个 UltraSpeed 不是 FP4 量化的吗,难道说普通的 Mimo 也是 FP4 的吗 ^-^

  • ZackWill 06-13 00:31
    6

    从官方技术文档来看只针对MOE部分做了MXFP4的量化,其他组件是保持原样的,所以能力不怎么会下降

  • 九十 06-13 00:33
    7

    请问大佬,这个UltraSpeed的智商感觉怎样呢?如果对标claude sonnect/opus 4.5-4.8 大概在哪个等级

* 帖子来源Linux.do
返回