五家欧洲公司刚刚同意购买尚不存在的AI算力

五家欧洲公司刚刚同意购买尚不存在的AI算力

💡 原文英文,约1000词,阅读约需4分钟。
📝

内容提要

Mistral AI宣布开始托管第三方开源模型,首个为Z.ai的GLM-5.2,提供欧洲和美国区域处理及优先服务层。此举旨在让企业统一使用不同模型,无需切换基础设施。GLM-5.2定价明确,但区域端点功能有限,优先层需定制。Mistral还推出欧洲计算单元,吸引企业长期承诺,强调基础设施比单一模型更重要。

🔎

延伸解读

区域端点的实际限制

Mistral的区域端点目前仅支持函数调用,不支持Agents、Batch或Files API。这意味着将现有应用迁移到欧洲或美国端点时,可能不只是更换URL那么简单。如果应用依赖这些未支持的功能,区域处理保证将不再适用。企业在规划迁移时,需先评估现有应用对API功能的依赖,避免因功能缺失导致服务中断或合规风险。

优先层的降级风险

Mistral的Priority Tier并非所有请求都能获得优先处理。请求只有在组织拥有有效权利、模型覆盖、自定义速率限制内且区域有容量时才会被优先处理,否则会自动降级到标准层。开发者应通过响应中的usage对象记录实际服务层,以监控降级频率。当延迟升高时,需区分是模型性能问题还是请求被降级,避免误判。

欧洲计算单元的未知数

Mistral推出的欧洲计算单元(ECU)允许客户跨产品灵活使用,但具体细节尚未公布:一个ECU对应多少算力、价格、未使用容量能否结转、基础设施未按时就绪的补偿等均未明确。企业签订多年承诺前,需仔细评估这些不确定性,并考虑合同条款是否包含对延迟交付或容量不足的保护措施。

Q&A

Mistral AI 最近宣布了什么新服务?

Mistral AI 宣布开始托管第三方开源模型,首个是来自中国 Z.ai 的 GLM-5.2,该模型将运行在 Mistral 的基础设施上,并提供区域处理和优先服务层。

GLM-5.2 的定价是多少?

GLM-5.2 通过 Mistral API 提供,价格为每百万输入 token 1.40 美元,每百万输出 token 4.40 美元,每百万缓存输入 token 0.14 美元。

Mistral 的区域推理服务有什么特点和限制?

区域推理服务允许开发者选择请求在欧盟或美国处理,可能降低延迟并满足数据位置要求,但会增加 10% 的成本。目前该服务不支持 Agents、Batch 和 Files API,且某些模型在特定区域可能不可用。

Mistral 的 Priority Tier 是如何工作的?

Priority Tier 将符合条件的 API 请求置于标准流量之前,并提供 99.5% 正常运行时间的 SLA。客户需与 Mistral 安排访问并协商每个模型的定制限制,然后可在请求中添加 service tier: auto。请求只有在组织有有效权限、模型被覆盖、请求在速率限制内且 Mistral 在该区域有容量时才会被优先处理,否则可能降级到标准层。

欧洲计算单元(ECU)是什么?

欧洲计算单元是 Mistral 推出的计算承诺单位,欧洲企业和机构可以承诺多年计算容量,获得 ECU 分配,并可在 Mistral 的不同产品间灵活使用。但 Mistral 尚未公布 ECU 的具体计算量、价格、未使用容量是否可结转等细节。

Mistral 托管第三方模型对企业的意义是什么?

Mistral 托管第三方模型让企业可以在一个平台上使用不同的开源模型,无需切换基础设施。这体现了 Mistral 的战略:基础设施比单一模型更重要,旨在让企业长期使用其基础设施。

🏷️

标签

➡️

继续阅读