谷歌发布三款新Gemini模型,但并非众人期待的那款。

谷歌发布三款新Gemini模型,但并非众人期待的那款。

💡 原文英文,约1100词,阅读约需4分钟。
📝

内容提要

谷歌发布三款新Gemini模型:3.6 Flash(更便宜高效,编码性能提升)、3.5 Flash-Lite(低成本高吞吐)和3.5 Flash Cyber(网络安全专用,仅限政府试点)。但旗舰3.5 Pro延迟发布,仍在测试中。新模型在基准测试中表现优于前代,但落后于部分竞品,价格竞争复杂。

🔎

延伸解读

旗舰缺席,Flash先行

谷歌此次发布三款新Gemini模型,但备受期待的旗舰3.5 Pro仍未亮相,已比原定六月发布推迟数周。谷歌表示Pro仍在与合作伙伴测试中,将尽快推出。这一策略显示谷歌优先更新中端和专用模型,而非旗舰,可能意在快速迭代以应对竞争,但也让等待旗舰的用户感到失望。

价格与性能的权衡

3.6 Flash在多数基准测试中超越前代,但并非全面领先。例如,在GDPval-AA v2上得分1421,低于Anthropic Claude Sonnet 5的1600和OpenAI GPT-5.6 Terra的1581。价格方面,3.6 Flash输出价格降至每百万token 7.5美元,但竞品如GPT-5.6 Luna更便宜(输入/输出$1/$6)。因此,选择模型需综合考量性能与成本。

网络安全模型的谨慎发布

3.5 Flash Cyber专为网络安全设计,性能据称优于Anthropic Opus 4.6,但仅限政府及可信伙伴试点,且仅通过CodeMender工具使用。此举反映前沿实验室对AI安全风险的谨慎态度,避免模型被滥用。同时,谷歌强调该模型成本与普通3.5 Flash相同,为防御者提供高效工具,但普通用户暂时无法使用。

Q&A

谷歌新发布的三个Gemini模型分别是什么?

谷歌发布了Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber三个模型。其中3.6 Flash是更便宜高效的更新版,3.5 Flash-Lite是低成本高吞吐的轻量级模型,3.5 Flash Cyber是专为网络安全优化的模型。

Gemini 3.5 Pro为什么没有发布?

Gemini 3.5 Pro是谷歌的旗舰模型,原计划在6月发布,但至今仍未推出。谷歌表示该模型目前正在与合作伙伴进行测试,并计划在准备好后尽快广泛提供。

Gemini 3.6 Flash在编码能力上表现如何?

在DeepSWE软件工程基准测试中,Gemini 3.6 Flash得分49%,明显高于前代3.5 Flash的37%,但低于Anthropic的Claude Sonnet 5(54%)和顶级前沿模型(70%以上)。

Gemini 3.5 Flash-Lite的定价和适用场景是什么?

Gemini 3.5 Flash-Lite的定价为每百万输入/输出token 0.3美元/2.5美元,比前代3.1 Flash Lite更贵。它适用于高吞吐量任务,如代理搜索和文档处理,不适用于需要复杂推理和规划的代理工作负载。

Gemini 3.5 Flash Cyber的独特之处和可用性如何?

Gemini 3.5 Flash Cyber是专为网络安全用例优化的模型,基于3.5 Flash构建,定价相同。它在漏洞发现方面表现优于Anthropic的Claude Opus 4.6,但目前仅限政府及可信合作伙伴通过Google的CodeMender工具进行有限访问试点,计划未来扩大访问范围。

Gemini 3.6 Flash在价格上有何调整?

Gemini 3.6 Flash的输入价格保持每百万token 1.5美元不变,但输出价格从每百万token 9美元降至7.5美元。此外,它在代理工作流中使用的推理步骤和工具调用更少,因此运行成本更低。

🏷️

标签

➡️

继续阅读