Multiverse Computing发布Quasar 438B:欧洲最强的模型

Bunn 2026-09-02 20:29 1

Multiverse Computing正式发布其首款大型语言模型,Quasar 438B。这是一款面向企业级智能体与编程任务的旗舰推理模型,支持英语和西班牙语,在Artificial Analysis智能指数(Intelligence Index v4.1.1)中获得43分,成为该榜单中得分最高的欧洲模型。


Artificial Analysis智能指数v4.1.1综合了九项评测:GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity’s Last Exam、GPQA Diamond、CritPt、AA-Omniscience及AA-LCR。






Quasar 438B以43分的综合成绩,在同类模型中表现突出:领先Mistral Medium 3.5(30分)达13分,领先NVIDIA Nemotron 3 Ultra(38分)达5分(而后者参数量比Quasar多出1120亿),领先Inkling(42分)1分。


Quasar 438B不仅智能,更兼具出色的响应速度。生成500个token(含思考时间)仅需15.3秒,在对比模型中排名前列。在所有参与对比的模型中,仅有三款速度更快:Nemotron 3.5 Lightning(9.4秒,指数得分24)、Gemini 3.5 Flash-Lite(10.8秒,指数得分37)和Gemini 3.7 Flash(11.5秒,指数得分56)。其中,仅Gemini 3.7 Flash在速度更快的同时,综合得分也高于Quasar。


在AA-LCR评测(考察模型跨长文档提取、关联与推理能力)中,Quasar获得75.0分,与Grok 4.6(high)并列,仅略低于Claude Opus 5(75.7分)和Qwen3.8 2.4T A95B(75.3分),同时领先Nemotron 3 Ultra 4.0分,领先Mistral Medium 3.5 9.7分。长上下文处理能力是企业级研究、文档分析和智能体工作流的核心基础,Quasar在这一维度已最接近前沿模型。


在Terminal-Bench v2.1评测(在真实终端环境中测试智能体实际执行能力)中,Quasar获得69.3分,领先Mistral Medium 3.5 18.7分,领先Nemotron 3 Ultra 15.4分,同时与当前领跑的Claude Opus 5(89.1分)仍有差距。这一方向也是Quasar下一阶段重点优化的目标。


Quasar专为运行软件开发智能体、技术副驾驶、研究系统及工作流自动化的组织而构建。其终端任务及长上下文评测结果,充分验证了其支持智能体在多步骤任务中保持上下文、协调行动的能力;而出色的响应速度,使其能够无缝嵌入交互式产品,而非沦为批处理任务。


对英语和西班牙语的双语支持,使Quasar成为欧洲及国际企业的实用选择,无需将部署语言局限于单一市场,可广泛应用于工程、运营及知识工作场景。


该模型现已通过CompactifAI API开放访问



最新回复 (4)
  • NukaColaM 09-02 20:31
    1

    欧公子表示我还能抢救一下的。 ^-^

  • unsafetrait 09-02 20:43
    2

    大声告诉我,是基于哪个模型?沙特号称自己全球最强了,基于MINIMAX M3 ^-^

  • Megasoft 09-02 21:15
    3

    不免费,那就不体验了


  • 皮皮鬼在密室 09-02 21:17
    4

    稍等。。。支持英语和西班牙语?意思是其他语言不支持吗,这还是我知道的LLM吗

* 帖子来源Linux.do
返回