Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 现已在 AI Gateway 上可用

Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 现已在 AI Gateway 上可用

💡 原文英文,约300词,阅读约需1分钟。
📝

内容提要

AI Gateway现已支持Gemini 3.6 Flash和3.5 Flash-Lite。前者提升编码、智能体及网页开发质量,减少令牌消耗;后者增强子任务处理能力。用户可通过AI SDK设置模型,享受统一API、成本追踪、重试及优化功能,且无加价或平台费。

🔎

延伸解读

模型选择建议

根据文章,Gemini 3.6 Flash 在编码、智能体任务和网页开发方面质量更高,且消耗更少的令牌和模型调用次数,适合需要高质量输出的场景。而 Gemini 3.5 Flash-Lite 则增强了子任务处理能力,适合作为处理大型任务中特定部分的子代理。用户可根据任务需求选择合适的模型。

AI Gateway 的优势

AI Gateway 提供统一 API,支持模型调用、使用量和成本追踪,以及重试、故障转移和性能优化,可提高可用性。此外,它还提供自定义报告、零数据保留支持、API 密钥预算和路由规则等功能。这些特性有助于企业更好地管理 AI 模型的使用。

成本透明性

文章明确指出,AI Gateway 反映提供商定价,不加价,也不对推理收取平台费,包括自带密钥(BYOK)请求。这意味着用户在使用这些新模型时,无需担心额外的平台费用,成本更加透明可控。

Q&A

AI Gateway 上新增了哪些 Gemini 模型?

AI Gateway 新增了 Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 两个模型。

Gemini 3.6 Flash 在哪些方面有所改进?

Gemini 3.6 Flash 在编码、智能体任务和网页开发方面提升了质量,同时消耗更少的令牌并减少模型调用次数,生成的网页和应用开发输出更干净。

Gemini 3.5 Flash-Lite 适合什么场景?

Gemini 3.5 Flash-Lite 增强了 Flash-Lite 级别的智能体能力,适合作为子代理处理较大任务中的特定部分。

如何在 AI SDK 中使用 Gemini 3.6 Flash?

在 AI SDK 中,将模型设置为 'google/gemini-3.6-flash' 即可,例如:streamText({ model: 'google/gemini-3.6-flash', prompt: '...' })。

AI Gateway 提供哪些功能?

AI Gateway 提供统一 API 调用模型、跟踪使用量和成本、配置重试、故障转移和性能优化,以实现高于提供商的正常运行时间。还包括内置自定义报告、零数据保留支持、API 密钥预算、路由规则等。

AI Gateway 的定价策略是什么?

AI Gateway 反映提供商定价,不加价,也不对推理收取平台费,包括自带密钥(BYOK)请求。

AI Gateway 的模型排行榜有什么作用?

AI Gateway 的模型排行榜根据所有网关流量处理的令牌总量,对热门模型进行排名,帮助用户了解模型的使用趋势。

🏷️

标签

➡️

继续阅读