谷歌发布了Gemini 3.8 Flash,距离其前代产品仅几周时间,因为为什么要让一个完美的命名方案积灰呢?该公司声称,这款新模型比Gemini 3.7 Flash“更努力”——大概是通过熬夜、在复杂任务上执行额外的推理步骤,同时“迭代调用工具”,这听起来令人筋疲力尽。

但转折来了:尽管保持了与3.7 Flash相同的入门价格——每百万输入token 0.75美元,每百万输出token 3.75美元——这款勤奋的小模型最终仍可能让你花费更多。谷歌警告说,带着额头拍击般的微妙,“该模型可能会使用更多token来最大化性能,尤其是在更高的努力水平下。”所以,这就像一个承包商按相同的小时费率收费,但突然花费两倍的时间,因为他真的致力于做一份彻底的工作。喜欢AI更像一个懒惰的天才的开发者,可以坚持使用Gemini 3.7 Flash来保持token使用量低。

早期印象正在涌现,它们是赞扬和计算的混合体。Artificial Analysis计算了数字,并宣称Gemini 3.8 Flash是“我们在这个智能水平上测量到的最便宜的”,但随后投下了重磅炸弹:“这比Gemini 3.7 Flash高出约40%,尽管每token定价不变,这是由于每个任务的输出token增加了30%,以及在代理评估中更多的轮次。”所以每个智商点更便宜,但每个任务你支付更多,因为它就是停不下来。

Aigora.ai的首席执行官John Ennis非常兴奋,将Gemini 3.8 Flash与Anthropic的模型进行比较:“Opus 5的编码质量,但成本只是其一小部分,而且超快。”他补充说:“这对于制作remotion视频之类的东西来说将非常棒。”我们相信他的话。

谷歌吹嘘软件工程和自主AI代理的“显著改进”。在DeepSWE v1.1软件工程基准测试中,它超越了其前代和其他前沿模型,包括Anthropic的Fable 5——后者本周早些时候获得了升级,也承诺以更低的价格提供更强的性能,通过降低使用缓存数据的价格。这是一场常规的AI军备竞赛。

新模型还在Vals金融代理V2基准测试和Harvey的法律代理基准测试中获胜。但为了防止你认为这全是乐趣和游戏,谷歌指出,Gemini 3.8 Flash“带有防止在化学、生物、放射性和核(CBRN)以及网络攻击领域滥用的保障措施。”因为即使勤奋的AI也需要被告知不要制造生物武器。

在相关举措中,谷歌发布了Gemini 3.8 Flash Cyber,以及其新的Fairwind计划,该计划严格面向政府和“受信任的合作伙伴”。该计划拥有650名成员,包括CrowdStrike和互联网安全中心,提供对3.8 Flash Cyber和谷歌的CodeMender代理的访问,后者可以“自主发现并修复漏洞,保护关键基础设施、公共服务和国家安全。”因为没有什么比政府批准的网络安全AI更能说明“受信任的合作伙伴”了。

Gemini 3.8 Flash现在可供拥有Google AI Pro或Ultra订阅的消费者使用,也可供开发者和企业用户使用。所以,如果你准备好让你的AI更努力(并可能向你收取更多费用),是时候升级了。