Multiverse称其438B模型对AI代理而言速度足够快。但基准测试揭示的情况更为复杂。

Multiverse称其438B模型对AI代理而言速度足够快。但基准测试揭示的情况更为复杂。

💡 原文英文,约800词,阅读约需3分钟。
📝

内容提要

西班牙公司Multiverse Computing发布4380亿参数模型Quasar 438B,专为编码和企业代理设计,输出速度约183 tokens/秒,上下文窗口达100万tokens,支持英语和西班牙语。其压缩技术可减少模型内存和计算需求,但未披露细节。Quasar在基准测试中表现优于部分欧洲模型,但落后于顶尖系统,目前仅通过API提供。

🔎

延伸解读

压缩技术的双刃剑

Multiverse的压缩技术号称可将模型体积减少80%至95%,但Quasar 438B的具体压缩比例和原始模型并未披露。这意味着其宣称的183 tokens/秒速度可能依赖于未公开的硬件配置和压缩细节。对于企业用户而言,这种不透明性增加了评估实际部署成本和性能的难度,尤其是在需要反复调用模型的代理场景中。

基准测试的定位与局限

Quasar在Artificial Analysis的智能指数上得分为43,高于Mistral Medium 3.5和NVIDIA Nemotron 3 Ultra,但在Terminal-Bench上仍落后于顶尖模型(如Claude Opus 5的89.1)。这表明Quasar在编码任务上并非最强,但可能凭借速度和成本优势,在特定企业代理应用中占据一席之地。然而,基准测试无法完全反映真实代理工作负载下的表现。

代理场景中的实际挑战

尽管Quasar的响应速度和生成速度较快,但代理任务涉及工具调用、上下文增长和多次模型调用,这些都会增加延迟。Multiverse未披露运行所需的硬件和压缩后的资源需求,使得开发者难以预估实际部署成本。此外,模型仅通过API提供,且不支持权重开放,限制了定制化和本地部署的可能性。

Q&A

Multiverse Computing发布的Quasar 438B模型参数量是多少?

Quasar 438B是一个拥有4380亿参数的模型。

Quasar 438B模型在编码和代理任务上的性能如何?

Quasar在Terminal-Bench v2.1上得分69.3,在Artificial Analysis的Intelligence Index上得分43,优于Mistral Medium 3.5和NVIDIA Nemotron 3 Ultra,但落后于顶尖系统如Claude Opus 5(89.1)。

Quasar 438B模型的输出速度和上下文窗口是多少?

Quasar的输出速度约为每秒183个token,上下文窗口为100万个token。

Multiverse的压缩技术有什么特点?

Multiverse的压缩技术(CompactifAI)可以将模型大小减少80%到95%,同时只损失少量精度,但未披露Quasar的具体压缩比例和原始模型。

Quasar 438B模型支持哪些语言?

Quasar支持英语和西班牙语。

Quasar 438B模型如何获取和使用?

Quasar是专有模型,只能通过Multiverse的CompactifAI API访问,开发者无法检查权重或在自己的硬件上运行。

Quasar 438B模型的主要应用场景有哪些?

Quasar主要面向软件工程、技术副驾驶、研究和流程自动化等场景。

Multiverse公司最近的融资情况如何?

Multiverse在7月宣布了5.7亿美元的C轮融资,用于扩展压缩模型库并商业化该技术。

🏷️

标签

➡️

继续阅读