谷歌在今年5月的I/O大会上发布了Gemini 3.5 Flash,凭此掀起了一波AI模型升级浪潮,而其在AI领域的步伐并未就此放缓。谷歌今日发布了三款全新AI模型,其中包括首个专为网络安全领域打造的Gemini版本。不过,原定于6月发布的Gemini 3.5 Pro仍未亮相。

Gemini 3.6 Flash

曾在I/O大会上大放异彩的Gemini 3.5 Flash已悄然退出舞台,取而代之的是Gemini 3.6 Flash。谷歌对新版本给出了惯常的描述——整体能力小幅提升、代码生成能力增强,同时具备出色的多模态功能。

谷歌表示,3.6 Flash的改进主要源于用户对3.5版本的反馈。总体来看,Gemini 3.5 Flash在代码生成方面未能达到谷歌当初的预期,这或许与谷歌在效率优化上的重心有关——随着企业对AI Token成本愈发敏感,效率正成为产品设计的优先考量。

在编程能力测试DeepSWE中,3.6 Flash的得分从3.5 Flash的37%跃升至49%。新模型还将"计算机使用"功能作为Gemini API的标准配置正式引入,在计算机使用测试OSWorld中,得分也从3.5版本的78.4%小幅提升至83%。此外,即便基准测试成绩仅有小幅提升,Gemini 3.6 Flash的Token消耗量也比上一版本减少了约17%。

在智能体工作流场景中,Gemini 3.6 Flash能以更高精度、更少步骤、更低Token消耗完成任务,有望为开发者和谷歌双方节省可观的成本。新模型的API定价同步调整:输入Token为每百万1.50美元,输出Token为每百万7.50美元(3.5 Flash时期的输出定价为9美元)。

Gemini 3.5 Flash Lite与3.5 Flash Cyber

谷歌并未止步于3.6 Flash,3.5系列同步迎来两款新成员:Gemini 3.5 Flash Lite和Gemini 3.5 Flash Cyber。

Gemini 3.5 Flash Lite是目前谷歌效率最高的现代AI模型,处理速度可达每秒350个Token。谷歌称其非常适合在不大幅增加成本的前提下扩展智能体系统。从基准测试数据来看,该模型的能力与大约一年前的前沿模型基本持平,而价格极为亲民:输入Token定价为每百万0.30美元,输出Token为每百万2.50美元(略高于上一代3.1 Flash Lite的0.25美元和1.50美元)。

Gemini 3.6 Flash即日起在API端开始分批推送,并将在Gemini应用中取代3.5 Flash;Gemini 3.5 Flash Lite也已同步向开发者和Gemini应用用户开放。谷歌还透露,该模型将大量用于谷歌搜索,其较高的处理速度使其非常适合驱动AI摘要功能,相关体验有望得到进一步提升。

网络安全专属模型Gemini 3.5 Flash Cyber

谷歌还推出了Gemini 3.5 Flash Cyber,这是谷歌首个专为网络安全场景调优的大语言模型。谷歌表示,该模型在网络安全漏洞发现与修复方面的能力接近体量更大、成本更高的Claude Mythos,同时保留了Flash系列的高效率特性。

谷歌同时承认此类模型具有"两用性"——既可用于防御,也可能被恶意利用来发现漏洞。出于安全考量,谷歌参照Anthropic的做法,将Gemini 3.5 Flash Cyber定性为不宜公开发布的高风险模型,计划以限量试点的形式,通过谷歌DeepMind旗下的CodeMender智能体平台率先推出,仅向可信合作伙伴及政府机构开放。

Gemini 3.5 Pro与Gemini 4的最新动态

至于备受关注的Gemini 3.5 Pro,谷歌早在I/O大会上便宣布将于6月发布,但最终未能如期落地,官方也一直未作说明。此次更新透露的信息依然有限:谷歌表示这款旗舰级新模型正在与部分未具名合作伙伴进行测试,将"准备就绪后立即发布"。此前有报道指出,延迟的原因在于Gemini 3.5 Pro在代码生成方面尚未达到竞品水准,目标是与GPT 5.6及Claude Fable/Sonnet 5一较高下。

此外,谷歌还透露Gemini 4的预训练工作已经启动,其训练规模据称比此前任何一代都更为雄心勃勃。目前尚无具体发布时间表,在Gemini 4到来之前是否还会有更多3.x版本发布,同样有待观察。

Q&A

Q1:Gemini 3.6 Flash相比3.5 Flash有哪些主要提升?

A:Gemini 3.6 Flash在编程能力测试DeepSWE中得分从37%升至49%,计算机使用测试OSWorld得分从78.4%提升至83%。Token消耗量减少约17%,输出Token定价从每百万9美元降至7.50美元。此外,"计算机使用"功能已成为Gemini API的标准配置,在智能体工作流场景中也能以更少步骤、更低成本完成任务。

Q2:Gemini 3.5 Flash Cyber是什么模型?为什么不公开发布?

A:Gemini 3.5 Flash Cyber是谷歌首个专为网络安全场景调优的大语言模型,具备接近Claude Mythos的漏洞发现与修复能力,同时保持Flash系列的高效率。由于该模型具有"两用性"——既能用于防御,也可能被用于恶意攻击,谷歌将其定性为高风险模型,目前仅通过DeepMind旗下的CodeMender智能体平台向可信合作伙伴及政府机构开放试点。

Q3:Gemini 3.5 Pro为什么还没发布?什么时候能正式推出?

A:谷歌原计划在今年6月发布Gemini 3.5 Pro,但最终未能如期上线。谷歌官方表示该模型目前正在与部分未具名合作伙伴进行测试,将"准备就绪后立即发布"。此前有报道称延迟原因是该模型在代码生成方面尚未达到GPT 5.6和Claude Fable/Sonnet 5等竞品的水准,具体发布时间仍未确定。

ArsTechnica - AI