周二,谷歌 DeepMind 正式发布了 Gemini 3.6 Flash、3.5 Flash-Lite 和 3.5 Flash Cyber 三款新模型。

Gemini 3.6 Flash 被定位为谷歌的"主力模型",在编程、知识工作和多模态性能方面均有所提升,同时将 Token 使用量降低最高达 17%,使其成本低于上一代的 3.5 Flash。

Gemini 3.5 Flash-Lite 则是该系列中性价比最高的模型;Gemini 3.5 Flash Cyber 是一款经过专项微调的安全模型,专为发现和修复网络安全漏洞而设计,且定价合理。谷歌表示,该模型将作为限量访问试点项目的一部分,仅向政府机构和受信合作伙伴开放。

谷歌强调,此次发布的重点在于为大规模构建 AI 智能体的客户提供更高的效率、更低的延迟和更强的可靠性。

然而,此次发布同样引人关注的,是谷歌"没有发布"的内容。本次更新并未包含外界期待已久的旗舰模型 Gemini Pro 的升级版本——该模型上一次更新还是在今年 2 月。

在此期间,竞争对手的发布节奏明显加快:OpenAI 已发布 GPT-5.5 并开始推出 GPT-5.6,Anthropic 则相继推出了 Claude Opus 4.8、Claude Sonnet 5,并扩大了其前沿模型 Fable 5 的访问权限,行业竞争态势愈发激烈。

谷歌曾在今年 5 月的 3.5 Flash 发布活动中预告 Pro 版本即将到来,称"Pro 版本已在内部使用,我们期待下个月正式推出"。然而据彭博社上周报道,由于难以达到内部性能指标,谷歌在 3.5 Pro 的发布上遭遇了内部延误。

Gemini Pro 系列通常是谷歌在复杂推理和编程任务方面能力最强的模型,而 Flash 系列则主要面向生产应用场景,更注重低成本和快速响应。

谷歌 DeepMind 产品负责人洛根·基尔帕特里克周二表示,团队目前正在与合作伙伴测试 Gemini 3.5 Pro,希望"尽快落地"。他还透露,团队已启动迄今为止规模最大的 Gemini 4 预训练计划。

Q&A

Q1:Gemini 3.6 Flash 和 3.5 Flash 相比有哪些改进?

A:Gemini 3.6 Flash 是谷歌新发布的"主力模型",相比上一代 3.5 Flash,它在编程、知识工作和多模态性能方面有所提升,同时将 Token 使用量降低最高达 17%,整体使用成本更低,更适合需要大规模部署 AI 智能体的企业客户。

Q2:Gemini 3.5 Flash Cyber 是什么模型?谁可以使用?

A:Gemini 3.5 Flash Cyber 是谷歌专为网络安全场景打造的模型,经过专项微调,能够帮助发现和修复网络安全漏洞,且定价较为合理。但该模型目前并不对公众开放,仅作为限量访问试点项目,面向政府机构和受信合作伙伴提供服务。

Q3:Gemini 3.5 Pro 为什么还没发布?什么时候能上线?

A:据彭博社报道,Gemini 3.5 Pro 因难以达到谷歌内部设定的性能指标而出现延误。谷歌 DeepMind 产品负责人洛根·基尔帕特里克表示,目前团队正在与合作伙伴进行测试,希望"尽快落地",但尚未给出明确的发布时间表。

TechCrunch - AI