AI Gateway 现已支持 OpenAI 为 GPT-6 Astra 推出的 Ultrafast 服务层级,可加快输出,适合交互应用与快速编码迭代。可通过 AI SDK、Chat Completions 或 Responses API 调用;频繁工具调用建议使用 Responses API 的持久 WebSocket 连接。Ultrafast 支持美国及全球处理,欧盟等不支持地区回退至标准层级。费用为标准每 token 费率的 6 倍,回退时按实际层级计费。
OpenAI推出GPT-6 Astra Ultrafast,运行于NVIDIA Blackwell GPU,通过持续推理优化,令牌生成速度比标准模式快8倍。该模型已上线OpenAI API,面向ChatGPT Work和Codex用户,可加速代码生成、工具调用和交互应用。OpenAI还利用自身模型优化GPU推理软件,提升性能与基础设施利用率。
Browser Use团队推出Jev Ultrafast超高速浏览器智能体,放弃传统截图模式,改用JavaScript提取网页DOM控件生成动态索引表,将操作预测与目标选择合并为单次网络请求,仅输入文本时调用小型模型。在谷歌机票搜索任务中仅用7.1秒,协议调用从1092次降至101次,单次成本约0.0039美元。安全方面,模型输出不生成选择器或代码,但阴影根节点、画布等仍是盲区。
OpenAI推出GPT-5.6 Sol UltraFast超快模式预览,面向企业,速度提升14倍,每秒生成750 tokens,适合实时语音、客服、金融等场景。该模式由Cerebras支持,需企业申请并经OpenAI审核,预览阶段资源有限,未来将扩大覆盖。
OpenAI推出GPT-5.6 Sol的Ultrafast服务,由Cerebras支持,速度比标准快14倍,每秒生成750个token,适用于事故响应、金融研究、客服、电商等实时场景。预览期与早期客户测试,并计划随容量扩大开放。
完成下面两步后,将自动完成登录并继续当前操作。