推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber

💡 原文英文,约1400词,阅读约需6分钟。
📝

内容提要

谷歌发布三款新Gemini模型:3.6 Flash提升编码和知识工作效率,输出token减少17%,成本更低;3.5 Flash-Lite速度最快,每秒350 token,性价比高;3.5 Flash Cyber专攻网络安全,仅限政府合作。3.5 Pro仍在测试,Gemini 4预训练已启动。

🔎

延伸解读

成本与效率的权衡

3.6 Flash在输出token上比3.5 Flash减少17%,且价格更低(输入$1.50/1M,输出$7.50/1M),这直接降低了代理任务的成本。对于高频调用API的开发者,这种效率提升意味着更少的推理步骤和工具调用,从而节省时间和费用。但需注意,实际节省取决于任务类型,并非所有场景都能达到基准测试中的65%降幅。

Flash-Lite的定位与性能

3.5 Flash-Lite以每秒350 token的速度成为3.5系列中最快的模型,价格仅为$0.3/1M输入和$2.5/1M输出,适合高吞吐量任务。它在编码和代理任务上甚至超越3 Flash,如SWE-Bench Pro(54.2% vs 49.6%)。开发者可根据需求调整思考级别,在低延迟和低成本之间权衡,但需注意其性能可能不及3.6 Flash。

网络安全模型的限制

3.5 Flash Cyber专为网络安全设计,在CodeMender中通过多代理协作达到前沿性能,但仅限政府和可信合作伙伴使用,且为有限访问试点。这种限制源于技术的双重用途,旨在防止滥用。对于普通开发者,该模型不可用,但可关注CodeMender的后续开放情况。

Q&A

Gemini 3.6 Flash相比3.5 Flash在输出token使用上减少了多少?

根据Artificial Analysis Index,Gemini 3.6 Flash的输出token使用量比3.5 Flash减少了17%,在某些基准测试(如DeepSWE)中甚至减少了65%。

Gemini 3.5 Flash-Lite的定价和速度是多少?

Gemini 3.5 Flash-Lite定价为每百万输入token 0.3美元,每百万输出token 2.5美元,速度达到每秒350个输出token,是3.5系列中速度最快的模型。

Gemini 3.5 Flash Cyber的发布方式和目标用户是什么?

Gemini 3.5 Flash Cyber是专为网络安全设计的模型,仅通过CodeMender以有限访问试点计划向政府和可信合作伙伴提供,旨在帮助前线防御者高效发现和修复漏洞,同时降低滥用风险。

Gemini 3.6 Flash在哪些基准测试上表现优于3.5 Flash?

Gemini 3.6 Flash在多个基准测试上优于3.5 Flash,例如DeepSWE(49% vs 37%)、MLE Bench(63.9% vs 49.7%)、OSWorld-Verified(83.0% vs 78.4%)和GDPval-AA v2(1421 vs 1349)。

Gemini 3.5 Flash-Lite在哪些任务上比3 Flash更优?

Gemini 3.5 Flash-Lite在多个agentic和编码评估中优于3 Flash,例如SWE-Bench Pro(54.2% vs 49.6%)和OSWorld-Verified(74.0% vs 65.1%),同时速度更快。

Gemini 3.6 Flash和3.5 Flash-Lite的可用性如何?

Gemini 3.6 Flash和3.5 Flash-Lite从今天开始可用,开发者可通过Gemini API(Google AI Studio和Android Studio)访问,企业可通过Gemini Enterprise Agent Platform访问,普通用户可通过Gemini应用使用,3.5 Flash-Lite也正在Google Search中推出。

🏷️

标签

➡️

继续阅读