AI Gateway 现已支持 OpenAI Ultrafast 模式

AI Gateway 现已支持 OpenAI Ultrafast 模式

💡 原文英文,约200词,阅读约需1分钟。
📝

内容提要

AI Gateway 现已支持 OpenAI 为 GPT-6 Astra 推出的 Ultrafast 服务层级,可加快输出,适合交互应用与快速编码迭代。可通过 AI SDK、Chat Completions 或 Responses API 调用;频繁工具调用建议使用 Responses API 的持久 WebSocket 连接。Ultrafast 支持美国及全球处理,欧盟等不支持地区回退至标准层级。费用为标准每 token 费率的 6 倍,回退时按实际层级计费。

🔎

延伸解读

Ultrafast 的适用场景与调用方式

Ultrafast 服务层级专为交互式应用和快速编码迭代设计,能加快输出速度。开发者可通过 AI SDK、Chat Completions API 或 Responses API 请求该层级,只需在调用时指定 serviceTier 为 ultrafast。对于需要频繁工具调用的工作流,OpenAI 建议使用 Responses API 的持久 WebSocket 连接,以减少轮次间的开销。

区域限制与回退机制

Ultrafast 支持美国及全球处理,但若请求被固定到不支持的区域(如欧盟),则会自动回退至标准(默认)层级。未指定服务层级时,标准处理仍是默认选项。这意味着部分地区的用户可能无法享受加速效果,需注意实际服务层级。

计费规则:加速成本与回退计费

使用 Ultrafast 层级时,费用为标准每 token 费率的 6 倍。若请求回退到其他层级,则按实际服务层级的费率计费。因此,在区域不支持或未指定层级的情况下,不会产生 Ultrafast 的额外费用。建议查看 GPT-6 Astra 模型页面获取当前费率。

❓

Q&A

AI Gateway 现在支持 OpenAI 的什么新服务层级?

AI Gateway 现已支持 OpenAI 为 GPT-6 Astra 推出的 Ultrafast 服务层级。

Ultrafast 模式适合哪些应用场景?

Ultrafast 模式适合交互应用和快速编码迭代,能加快输出。

如何通过 AI SDK 调用 Ultrafast 模式?

在 AI SDK 中,使用 generateText 并设置 providerOptions.openai.serviceTier 为 'ultrafast',同时指定 gateway.only 为 ['openai']。

频繁工具调用时,OpenAI 推荐使用哪个 API?

OpenAI 推荐使用 Responses API 并通过持久 WebSocket 连接,以减少轮次间的开销。

Ultrafast 模式在哪些地区可用?不支持的地区会怎样?

Ultrafast 支持美国和全球处理。请求被固定到不支持的地区(如欧盟)时,会回退到标准(默认)层级。

Ultrafast 模式的计费方式是怎样的?

Ultrafast 请求按标准每 token 费率的 6 倍计费;如果回退到其他层级,则按实际服务层级的费率计费。

🏷️

标签

➡️

继续阅读