开放权重模型现已处理Vercel AI网关的大部分token流量,但Anthropic仍占据64%的支出。

开放权重模型现已处理Vercel AI网关的大部分token流量,但Anthropic仍占据64%的支出。

💡 原文英文,约1000词,阅读约需4分钟。
📝

内容提要

Vercel数据显示,8月开放权重模型占其AI网关56%的token流量,首次过半,去年12月仅7%;但因价格低廉,仅占支出14%,Anthropic模型仍占支出64%。报告指出,用户忠诚于模型特性而非品牌,新模型无法满足需求时会转向其他厂商。

🔎

延伸解读

token流量与支出份额的背离

开放权重模型在8月处理了Vercel AI网关56%的token,但仅占支出的14%,而Anthropic模型占支出的64%。这种背离源于开放权重模型通常更便宜,因此高token份额并不等同于高支出份额。读者需注意,token量反映的是推理工作量,而非资金流向,评估市场格局时应区分两者。

模型忠诚度:特性而非品牌

Vercel报告指出,用户忠诚于模型特性而非品牌。例如,Anthropic的Fable 5使用量下降,但更便宜的Opus 5使用量上升,使Anthropic整体支出份额保持稳定。这表明,当同一实验室推出价格更低、能力相近的模型时,用户愿意迁移,但不会轻易转向其他品牌。

跨实验室迁移的风险与信号

当新模型无法满足原有需求时,用户会跨实验室迁移。Google的Gemini 3 Flash使用量下降后,超过四分之三的流失量转向了OpenAI和Anthropic等厂商,导致Google的token份额从30%降至5%。这提醒模型提供商,保持模型特性的连续性至关重要,否则可能迅速失去市场份额。

Q&A

开放权重模型在Vercel AI网关的token流量占比是多少?

2025年8月,开放权重模型占Vercel AI网关总token流量的56%,这是首次超过一半。

为什么开放权重模型处理了大部分token但支出占比却很低?

因为开放权重模型(如DeepSeek、Moonshot AI、Z.ai)通常比美国前沿实验室的专有模型更便宜,所以尽管处理了56%的token,它们仅占网关支出的14%。

Anthropic在Vercel AI网关的支出占比是多少?

2025年8月,Anthropic模型占Vercel AI网关总支出的64%,且自2025年12月以来其份额从未低于61%。

Vercel AI网关的每token平均价格有何变化?

2025年8月,每token平均价格下降了23.2%,这是连续第三个月下降。对于7月和8月处理超过1000万token的团队,每token中位成本下降了7.6%。

用户对AI模型品牌的忠诚度如何?

用户忠诚于模型特性而非品牌。当新模型无法满足需求时,用户会转向其他厂商。例如,超过四分之三的Gemini 3 Flash流失量转向了OpenAI和Anthropic等提供商的模型。

Anthropic内部模型使用有何变化?

Anthropic的Fable 5支出占比从7月的13.2%降至8月的4.9%,而更便宜的Opus 5升至22.5%。90%使用Fable的团队减少了使用量,更多转向Opus 5,因为Opus 5以约一半价格处理类似工作负载。

🏷️

标签

➡️

继续阅读