内容提要
AI Gateway现已支持Gemini 3.6 Flash和3.5 Flash-Lite。前者提升编码、智能体及网页开发质量,减少令牌消耗;后者增强子任务处理能力。用户可通过AI SDK设置模型,享受统一API、成本追踪、重试及优化功能,且无加价或平台费。
延伸解读
模型选择建议
根据文章,Gemini 3.6 Flash 在编码、智能体任务和网页开发方面质量更高,且消耗更少的令牌和模型调用次数,适合需要高质量输出的场景。而 Gemini 3.5 Flash-Lite 则增强了子任务处理能力,适合作为处理大型任务中特定部分的子代理。用户可根据任务需求选择合适的模型。
AI Gateway 的优势
AI Gateway 提供统一 API,支持模型调用、使用量和成本追踪,以及重试、故障转移和性能优化,可提高可用性。此外,它还提供自定义报告、零数据保留支持、API 密钥预算和路由规则等功能。这些特性有助于企业更好地管理 AI 模型的使用。
成本透明性
文章明确指出,AI Gateway 反映提供商定价,不加价,也不对推理收取平台费,包括自带密钥(BYOK)请求。这意味着用户在使用这些新模型时,无需担心额外的平台费用,成本更加透明可控。
Q&A
AI Gateway 上新增了哪些 Gemini 模型?
AI Gateway 新增了 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 两个模型。
Gemini 3.6 Flash 在哪些方面有所改进?
Gemini 3.6 Flash 在编码、智能体任务和网页开发方面提升了质量,同时消耗更少的令牌并减少模型调用次数,生成的网页和应用开发输出更干净。
Gemini 3.5 Flash-Lite 适合什么场景?
Gemini 3.5 Flash-Lite 增强了 Flash-Lite 级别的智能体能力,适合作为子代理处理较大任务中的特定部分。
如何在 AI SDK 中使用 Gemini 3.6 Flash?
在 AI SDK 中,将模型设置为 'google/gemini-3.6-flash' 即可,例如:streamText({ model: 'google/gemini-3.6-flash', prompt: '...' })。
AI Gateway 提供哪些功能?
AI Gateway 提供统一 API 调用模型、跟踪使用量和成本、配置重试、故障转移和性能优化,以实现高于提供商的正常运行时间。还包括内置自定义报告、零数据保留支持、API 密钥预算、路由规则等。
AI Gateway 的定价策略是什么?
AI Gateway 反映提供商定价,不加价,也不对推理收取平台费,包括自带密钥(BYOK)请求。
AI Gateway 的模型排行榜有什么作用?
AI Gateway 的模型排行榜根据所有网关流量处理的令牌总量,对热门模型进行排名,帮助用户了解模型的使用趋势。