MiniMax M3测评:进步了,但雷霆大思考

HCPTangHY 2026-06-01 10:13 1



今天早上测这么几道题给我截断了一万次。思考效率比deepseek都差,经常是思维链吃满output token就断了


总之就是,相比于自家的2.5和2.7进步卓著,并且M3拓展到了1M上下文并且有多模态。能力还算说的过去







能力实际来说中等偏下,和半年前的GLM5打个平手。


但是还是要说,这个API价格不太美丽呢,就算走code plan也是有点小贵的

最新回复 (12)
  • HCPTangHY 楼主 06-01 10:16
    1

    就算是内测资格的 max 也不太耐用,早上两给小时的测试吃了 12% 的 5h,周限已经吃了 2% 了。我还没上 agent,都是纯粹单次 API 请求

  • Cimix 06-01 10:18
    2

    刚才在opencode里面跑了个案例,看了下代码还是比较拉裤兜的,如果在dsv4 flash和m3中间选一个,我还是选ds,速度和价格碾压了,效果虽然ds稍逊一点但审计起来的代码逻辑性比m3更像个人

  • 火星文专家 06-01 10:20
    3

    minimax有点赛博精神病,时不时给你搞波大的,根本不敢给全自动权限

  • jcc 06-01 10:22
    4

    目前glm-5.1还是最舒服的,不知道glm什么时候更新新的版本

  • Mozi 06-01 10:44
    5

    吐字速度怎么样

    如果有100 token还好

    但是我也不会原价买

  • fengchris 06-01 10:48
    6

    它这价格性能不太行啊 mimo-2.5-pro都干不过


    盲猜参数量没过1T 估计五六百B


    PS:它这思考token不要钱么 太过度了

  • HLAIA光子 06-01 10:48
    7

    glm新版本要是能力不行,我觉得宁愿不发。5.1是现在国模迈不过去的一个坎了

  • jcc 06-01 10:49
    8

    glm目前没有对手,估计不着急发吧。需要有人给上点压力了

  • Ronin 06-01 10:51
    9

    我觉得就是挤牙膏模式了,国模等哪个突然爆出比它能打了,那就是更新小版本时机。

  • bigYao 06-01 10:53
    10

    奶奶个腿的,啥时候加的周限呢,2个月前买的时候好像没看到有周限啊

  • YGYOOO 06-02 21:01
    11

    看它宣传的跑分还可以,竟然这么拉

  • CZ 06-06 19:33
    12

    目前在 claude code 里用 minimax,主要是各种 agent 的场景,特点是思考很重,非常重。但整体结果我觉得是比之前的 2.7 好很多,使用工具的准确率,比 deepseek v4 pro 高不少

* 帖子来源Linux.do
返回