内容提要
Google的Gemini 3.8 Flash模型已在AI Gateway上线,年底前享五折优惠。该模型支持1M token上下文,可处理文本、图像、PDF和视频,输出文本,支持工具调用和网络搜索,最大输出65,536 tokens。它在软件工程、代理工作和多步推理上优于前代,速度成本不变,默认开启思考功能。用户可通过AI SDK等工具使用。
延伸解读
价格优惠与计费说明
Gemini 3.8 Flash 在 AI Gateway 上线,年底前享受五折优惠。AI Gateway 不额外加价,也不收取平台推理费用,包括 BYOK 请求。这意味着开发者可以以较低成本试用新模型,但需注意优惠截止日期为 12 月 31 日,之后价格可能恢复原价。
功能亮点与适用场景
该模型支持 1M token 上下文,可处理文本、图像、PDF 和视频输入,并输出文本。它支持工具调用和网络搜索,最大输出 65,536 tokens。这些特性使其适合需要长上下文和多模态输入的复杂任务,如软件工程、代理工作及多步推理。
性能与成本优势
Gemini 3.8 Flash 在软件工程、代理工作和多步推理方面优于前代 Flash 模型,但速度和成本保持不变。思考功能默认开启,有助于提升推理能力。开发者可通过 AI SDK 或编码代理(如 Claude Code、Codex)集成使用,设置模型为 google/gemini-3.8-flash 即可。
Q&A
Gemini 3.8 Flash 在 AI Gateway 上的价格优惠是什么?
Gemini 3.8 Flash 在 AI Gateway 上提供五折优惠,该优惠持续到12月31日。
Gemini 3.8 Flash 支持哪些输入和输出类型?
Gemini 3.8 Flash 支持文本、图像、PDF和视频输入,输出为文本。
Gemini 3.8 Flash 的上下文窗口和最大输出 token 是多少?
Gemini 3.8 Flash 的上下文窗口为 1M token,最大输出为 65,536 tokens。
Gemini 3.8 Flash 相比前代模型有哪些改进?
Gemini 3.8 Flash 在软件工程、代理工作和多步推理方面优于前代 Flash 模型,同时速度和成本保持不变。
Gemini 3.8 Flash 是否默认开启思考功能?
是的,Gemini 3.8 Flash 默认开启思考功能。
如何在 AI Gateway 上使用 Gemini 3.8 Flash?
可以通过 AI SDK 等工具使用,将模型设置为 'google/gemini-3.8-flash'。例如,在 AI SDK 中使用 streamText 函数,并传入模型名称。
AI Gateway 对推理收费吗?
AI Gateway 反映提供商定价,不加价,也不对推理收取平台费用,包括 BYOK 请求。