推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber

💡 原文英文,约1500词,阅读约需6分钟。
📝

内容提要

谷歌发布三款新Gemini模型:3.6 Flash提升编码和知识工作效率,输出令牌减少17%,成本更低;3.5 Flash-Lite速度最快,每秒350令牌,性价比高;3.5 Flash Cyber专攻网络安全,仅限政府合作。3.5 Pro仍在测试,Gemini 4预训练已启动。

🔎

延伸解读

成本与效率的权衡

3.6 Flash在输出令牌上比3.5 Flash减少17%,且定价更低(输入$1.50/1M,输出$7.50/1M),这直接降低了代理任务的总体成本。对于高频调用API的开发者,这种效率提升意味着更少的推理步骤和工具调用,从而节省时间和费用。但需注意,实际节省取决于具体工作负载,并非所有任务都能达到基准测试中的65%降幅。

Flash-Lite的定位与性能

3.5 Flash-Lite以每秒350输出令牌的速度成为3.5系列中最快的模型,定价仅为$0.3/1M输入和$2.5/1M输出,适合高吞吐量场景。它在多个基准上甚至超越3 Flash,如SWE-Bench Pro(54.2% vs 49.6%),但性能提升因任务而异。开发者可通过调整思考级别来平衡延迟和成本,但需注意其能力上限,复杂任务可能仍需更高阶模型。

网络安全模型的限制

3.5 Flash Cyber专为网络安全设计,在CodeMender中通过多代理协作达到前沿性能,但仅限政府及可信合作伙伴通过有限试点使用。这种限制源于技术的双重用途,旨在防止滥用。对于普通开发者,该模型不可用,因此其实际效果和适用性尚待验证。同时,它基于3.5 Flash微调,可能继承其某些局限性。

Q&A

谷歌新发布的Gemini 3.6 Flash模型在哪些方面有所提升?

Gemini 3.6 Flash在编码、知识工作和多模态性能上有所提升,输出令牌使用量比3.5 Flash减少17%,成本更低,且在多个基准测试中表现更优,如DeepSWE、MLE Bench、OSWorld-Verified等。

Gemini 3.5 Flash-Lite的定价和速度是多少?

Gemini 3.5 Flash-Lite定价为每百万输入令牌0.3美元,每百万输出令牌2.5美元,速度达到每秒350个输出令牌,是3.5系列中速度最快的模型。

Gemini 3.5 Flash Cyber的发布有什么特殊限制?

Gemini 3.5 Flash Cyber专攻网络安全,由于技术的双重用途性质,该模型将仅通过CodeMender提供给政府和可信合作伙伴,作为有限访问试点计划的一部分。

Gemini 3.6 Flash在成本方面相比3.5 Flash有何优势?

Gemini 3.6 Flash的定价为每百万输入令牌1.5美元,每百万输出令牌7.5美元,比3.5 Flash更低,同时输出令牌使用量减少17%,从而降低了每个代理任务的总成本。

Gemini 3.5 Flash-Lite在哪些基准测试中表现优于3 Flash?

Gemini 3.5 Flash-Lite在SWE-Bench Pro(54.2% vs 49.6%)和OSWorld-Verified(74.0% vs 65.1%)等基准测试中优于3 Flash,使其成为2.5和3 Flash工作负载的更快、更强大的选择。

Gemini 3.6 Flash和3.5 Flash-Lite现在可以在哪些平台使用?

Gemini 3.6 Flash和3.5 Flash-Lite从今天开始可用:开发者可通过Gemini API、Google AI Studio和Android Studio使用;企业可通过Gemini Enterprise Agent Platform使用;普通用户可通过Gemini应用使用,3.5 Flash-Lite也正在Google搜索中推出。

🏷️

标签

➡️

继续阅读