周二,谷歌DeepMind发布了Gemini 3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber。Gemini 3.6 Flash是谷歌的“主力模型”,号称在编码、知识工作和多模态性能上有所提升,同时将token使用量降低高达17%,比前代3.5 Flash更便宜。

Gemini 3.5 Flash-Lite是该系列中最具性价比的模型,而3.5 Flash Cyber则是一款专门针对发现和修复网络安全漏洞进行微调的模型,价格合理。据谷歌称,该模型将作为有限访问试点计划的一部分,独家提供给政府和受信任的合作伙伴。

谷歌表示,这些发布的重点是向大规模构建AI代理的客户提供效率、低延迟和可靠性。

这次发布引人注目,不仅因为谷歌推出了什么——更便宜、更快的模型,针对编码、效率和网络安全进行了优化——还因为它没推出什么。这次更新不包括人们期待已久的旗舰模型Gemini Pro的升级,该模型上次更新是在二月份。

自那次发布以来,OpenAI已经发布了GPT-5.5并开始推出GPT-5.6,而Anthropic则推出了Claude Opus 4.8和Claude Sonnet 5,并扩大了其前沿模型Fable 5的访问权限,凸显了竞争对手实验室的密集发布节奏。

谷歌曾在五月份发布3.5 Flash时暗示了Pro的发布,称Pro版本“已在内部使用,我们期待下个月推出”。上周,彭博社报道称,谷歌在推出3.5 Pro时面临内部延迟,因为其难以达到内部性能目标。

Gemini Pro模型通常是谷歌在复杂推理和编码任务中能力最强的产品,而Flash模型则优先考虑较低成本和更快的响应时间,适用于生产应用。

谷歌DeepMind产品负责人Logan Kilpatrick周二表示,公司目前正在与合作伙伴测试Gemini 3.5 Pro,并希望“很快落地”。他还指出,团队已经开始为Gemini 4进行迄今为止最雄心勃勃的预训练。