Quasar 438B 发布:欧洲得分最高的推理模型

Quasar 438B 是 Artificial Analysis Intelligence Index 上得分最高的欧洲模型

Multiverse Computing 发布了 Quasar 438B,这是一款专为企业级智能体和编程设计的推理模型。该模型在 Artificial Analysis Intelligence Index v4.1.1 上获得了 43 分,是该基准测试中任何欧洲模型的最高得分。它旨在处理需要规划、工具使用、代码执行和大上下文窗口的多步任务,并可通过 CompactifAI API 获取。

性能与智能基准测试

Quasar 438B 在 Artificial Analysis Intelligence Index(由包括 GPQA Diamond 和 SciCode 在内的九项评估组成的综合指标)上获得 43 分,使其领先于其他几个模型,包括:

  • Inkling: 42
  • NVIDIA Nemotron 3 Ultra: 38
  • Mistral Medium 3.5: 30

虽然它领先于这些模型,但仍落后于 Claude Opus 5 等前沿模型,后者以 63 分领跑该指数。

延迟与响应速度

Quasar 438B 在 400B+ 参数级别中针对低延迟进行了优化。它在 15.3 秒内返回 500 个 token(包括思考时间)。与其他高分模型相比:

  • Mistral Medium 3.5: 18.8 秒 (Score: 30)
  • NVIDIA Nemotron 3 Ultra: 25.7 秒 (Score: 36)
  • Inkling: 48.3 秒 (Score: 42)

在对比中只有三个模型更快:Nemotron 3.5 Lightning (9.4s)、Gemini 3.5 Flash-Lite (10.8s) 和 Gemini 3.7 Flash (11.5s)。其中,只有 Gemini 3.7 Flash 在智能指数上优于 Quasar 且响应速度更快。

长上下文与智能体能力

Quasar 438B 在长上下文推理和基于终端的智能体工作方面表现出强大的性能:

  • Long-Context Reasoning (AA-LCR): Quasar 获得 75.0 分,与 Grok 4.6 (high) 持平,并与 Claude Opus 5 (75.7) 和 Qwen3.8 2.4T A95B (75.3) 的差距在 1 分以内。
  • Agentic Coding (Terminal-Bench v2.1): Quasar 获得 69.3 分,领先 Mistral Medium 3.5 18.7 分,领先 Nemotron 3 Ultra 15.4 分,尽管它落后于 Claude Opus 5 (89.1)。

社区批评与技术质疑

在发布公告后,Hacker News 上的技术讨论引发了关于该模型来源、透明度和公司声明的若干关注。

模型来源与透明度

批评者指出,该模型在是全新预训练还是现有模型的压缩/微调版本方面缺乏透明度。一些用户根据参数量和更新日志条目建议,它可能是 GLM 5.2 或 MiniMax M3 的修改版本。

"I think this is GLM 5.2 with parameters removed. Its advertised in their changelog as 'capabilities are identical to GLM 5.2,' it has the same two effort settings 'high' and 'max'"

对 "Quantum AI" 声明的质疑

Multiverse Computing 使用 "quantum physics" 和 "tensor networks" 通过其 CompactifAI 技术进行模型压缩,这遭到了质疑。用户质疑量子算法在当前 LLM 开发中的实用性,并将该公司的部分营销手段描述为 "technobabble"。

权重开放与基准测试

由于 Quasar 438B 仅通过 API 提供且权重不公开,一些开发者对提供的基准测试表示不信任,并指出 "前沿" 模型通常包含隐藏的系统提示词或封装器,从而使分数与 "裸" 开源权重模型相比时显得虚高。

"When the weights are closed I don't believe any benchmark... 'Frontier' models get tested as a model + whatever secret sauce they choose to put in front."

部署与可用性

Quasar 438B 支持英语和西班牙语,并可通过 CompactifAI API 获取,允许企业团队将该模型集成到软件开发智能体、技术副驾驶 (copilots) 和研究系统,而无需管理自己的基础设施。

Sources

相关