推出Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber
内容提要
谷歌发布Gemini 3.6 Flash与3.5 Flash-Lite模型,提升AI代理效率与质量。3.6 Flash减少17%输出token,成本更低,性能增强;3.5 Flash-Lite速度最快,性价比高。另推出3.5 Flash Cyber用于网络安全,仅限政府及合作伙伴。3.5 Pro测试中,Gemini 4预训练已启动。
延伸解读
成本与效率的权衡
3.6 Flash在降低输出token用量的同时,价格也低于3.5 Flash(输入$1.5/百万,输出$7.5/百万)。这意味着在完成相同任务时,总成本可能更低,尤其适合高频调用的代理工作流。但开发者需注意,效率提升可能伴随模型行为变化,建议在具体任务上重新评估。
Flash-Lite的定位与性能
3.5 Flash-Lite主打速度和性价比,输出速度达350 token/秒,价格仅为3.5 Flash的约五分之一。它在多个基准上甚至超越3 Flash,但性能仍低于3.6 Flash。适合高吞吐、低延迟场景,如文档处理、搜索等,但复杂推理任务可能仍需更高阶模型。
网络安全模型的受限发布
3.5 Flash Cyber专为网络安全设计,但仅限政府和可信合作伙伴通过CodeMender使用,属于有限试点。这反映了双用途技术的谨慎部署策略。普通开发者无法直接访问,需关注后续是否扩大范围。
Q&A
Gemini 3.6 Flash相比3.5 Flash在token效率和成本上有哪些改进?
Gemini 3.6 Flash在Artificial Analysis Index上减少了17%的输出token使用,在某些基准测试(如DeepSWE)中甚至减少高达65%的token,同时价格更低:输入token每百万$1.50,输出token每百万$7.50,降低了每个代理任务的总成本。
Gemini 3.5 Flash-Lite的主要特点和适用场景是什么?
3.5 Flash-Lite是3.5系列中速度最快的模型,输出速度达350 tokens/秒,价格极低(输入$0.3/百万,输出$2.5/百万),适合低延迟和高吞吐量任务,如代理搜索和文档处理。它支持可配置的思考级别,并内置计算机使用工具,在编码和代理任务上表现优异。
Gemini 3.5 Flash Cyber是什么?它如何部署?
3.5 Flash Cyber是基于3.5 Flash微调的安全专用模型,用于检测、验证和修复代码安全漏洞,与CodeMender代理结合使用。由于技术的双重用途性质,它仅通过有限访问试点计划提供给政府和受信任的合作伙伴,以帮助防御者优先修复关键漏洞。
Gemini 3.6 Flash在哪些基准测试上表现优于3.5 Flash?
3.6 Flash在多个基准上优于3.5 Flash:DeepSWE(49% vs 37%)、MLE Bench(63.9% vs 49.7%)、OSWorld-Verified(83.0% vs 78.4%)、GDPval-AA v2(1421 vs 1349)。
Gemini 3.5 Flash-Lite与3 Flash相比性能如何?
3.5 Flash-Lite在多个代理和编码评估中优于3 Flash,例如SWE-Bench Pro(54.2% vs 49.6%)和OSWorld-Verified(74.0% vs 65.1%),同时速度更快,是2.5和3 Flash工作负载的更优选择。
Gemini 3.6 Flash和3.5 Flash-Lite现在可以在哪些平台使用?
两者今天起可通过Gemini API在Google AI Studio和Android Studio使用,3.6 Flash还可在Google Antigravity和Gemini Enterprise中使用,3.5 Flash-Lite也正在Google Search中推出。
Gemini 3.6 Flash在安全方面有哪些增强?
3.6 Flash增强了前沿安全防护,特别是在化学、生物、放射性和核(CBRN)以及网络攻击滥用领域,使模型更能抵抗越狱攻击,同时训练以减少对有益用途的拒绝。