Multiverse Computing正式发布其首款大型语言模型,Quasar 438B。这是一款面向企业级智能体与编程任务的旗舰推理模型,支持英语和西班牙语,在Artificial Analysis智能指数(Intelligence Index v4.1.1)中获得43分,成为该榜单中得分最高的欧洲模型。
Artificial Analysis智能指数v4.1.1综合了九项评测:GDPval-AA v2、τ³-Banking、Terminal-Bench v2.1、SciCode、Humanity’s Last Exam、GPQA Diamond、CritPt、AA-Omniscience及AA-LCR。
Quasar 438B以43分的综合成绩,在同类模型中表现突出:领先Mistral Medium 3.5(30分)达13分,领先NVIDIA Nemotron 3 Ultra(38分)达5分(而后者参数量比Quasar多出1120亿),领先Inkling(42分)1分。
Quasar 438B不仅智能,更兼具出色的响应速度。生成500个token(含思考时间)仅需15.3秒,在对比模型中排名前列。在所有参与对比的模型中,仅有三款速度更快:Nemotron 3.5 Lightning(9.4秒,指数得分24)、Gemini 3.5 Flash-Lite(10.8秒,指数得分37)和Gemini 3.7 Flash(11.5秒,指数得分56)。其中,仅Gemini 3.7 Flash在速度更快的同时,综合得分也高于Quasar。
在AA-LCR评测(考察模型跨长文档提取、关联与推理能力)中,Quasar获得75.0分,与Grok 4.6(high)并列,仅略低于Claude Opus 5(75.7分)和Qwen3.8 2.4T A95B(75.3分),同时领先Nemotron 3 Ultra 4.0分,领先Mistral Medium 3.5 9.7分。长上下文处理能力是企业级研究、文档分析和智能体工作流的核心基础,Quasar在这一维度已最接近前沿模型。
在Terminal-Bench v2.1评测(在真实终端环境中测试智能体实际执行能力)中,Quasar获得69.3分,领先Mistral Medium 3.5 18.7分,领先Nemotron 3 Ultra 15.4分,同时与当前领跑的Claude Opus 5(89.1分)仍有差距。这一方向也是Quasar下一阶段重点优化的目标。
Quasar专为运行软件开发智能体、技术副驾驶、研究系统及工作流自动化的组织而构建。其终端任务及长上下文评测结果,充分验证了其支持智能体在多步骤任务中保持上下文、协调行动的能力;而出色的响应速度,使其能够无缝嵌入交互式产品,而非沦为批处理任务。
对英语和西班牙语的双语支持,使Quasar成为欧洲及国际企业的实用选择,无需将部署语言局限于单一市场,可广泛应用于工程、运营及知识工作场景。
该模型现已通过CompactifAI API开放访问
artificialanalysis.ai
Quasar 438B - Intelligence, Performance & Price Analysis | Artificial Analysis
Analysis of Multiverse Computing's Quasar 438B and comparison to other AI models across key metrics including quality, price, performance (tokens per second & time to first token), context window & more.