Googleは、前モデルからわずか数週間後にGemini 3.8 Flashを世界に解き放ちました。なぜなら、せっかくの命名スキームをほこりをかぶせておく理由がないからです。同社は、この新しいモデルがGemini 3.7 Flashよりも「より懸命に働く」と主張しています。おそらく、複雑なタスクで徹夜をし、追加の推論ステップを実行し、「ツールを反復的に呼び出しながら」—それは exhausting に聞こえます。

しかし、ここにひねりがあります:3.7 Flashと同じ導入価格(入力100万トークンあたり0.75ドル、出力100万トークンあたり3.75ドル)を維持しているにもかかわらず、この勤勉な小さなモデルは、結局あなたにより多くのコストがかかる可能性があります。Googleは、額を叩かれるような微妙さで、「モデルはパフォーマンスを最大化するためにより多くのトークンを使用する可能性があり、特に高い努力レベルでは」と警告しています。つまり、それは同じ時間給を請求するが、徹底的な仕事に取り組むことに専念しているため、突然2倍の時間がかかる請負業者のようなものです。AIが怠惰な天才であることを好む開発者は、トークン使用量を抑えるためにGemini 3.7 Flashを使い続けることができます。

初期の印象は、賞賛と計算が混ざったものです。Artificial Analysisは数字を計算し、Gemini 3.8 Flashを「このレベルの知能で測定した中で最も安価」と宣言しましたが、その後爆弾を落としました:「これは、トークンあたりの価格が変わらないにもかかわらず、Gemini 3.7 Flashから約40%増加しており、タスクあたりの出力トークンが30%増加し、エージェント評価でのターン数が増えたことが原因です。」つまり、IQポイントあたりでは安いが、タスクあたりではより多く支払うことになります。なぜなら、それはおしゃべりを止めることができないからです。

Aigora.aiのCEO、John Ennis氏は、Gemini 3.8 FlashをAnthropicのモデルと比較して、非常に興奮しています:「Opus 5のコーディング品質を、はるかに低いコストで、しかも超高速で実現。」彼はさらに、「これはremotionビデオのようなものにとって非常に素晴らしいものになるでしょう」と付け加えています。私たちは彼の言葉を信じることにします。

Googleは、ソフトウェアエンジニアリングと自律型AIエージェントにおける「大幅な改善」を宣伝しています。DeepSWE v1.1ソフトウェアエンジニアリングベンチマークでは、前モデルや、今週初めにアップグレードされ、キャッシュデータの使用価格を引き下げることで、より低価格でより強力なパフォーマンスを約束するAnthropicのFable 5を含む他のフロンティアモデルを上回りました。それは、AIの一騎打ちの定期的な軍拡競争です。

新しいモデルはまた、Vals Finance Agent V2ベンチマークとHarveyのLegal Agentベンチマークで勝利を主張しました。しかし、それがすべて楽しいゲームだと思わないように、GoogleはGemini 3.8 Flashが「化学、生物、放射線、核(CBRN)およびサイバー攻撃の領域での悪用に対する保護手段を備えて出荷される」と述べています。勤勉なAIでさえ、生物兵器を構築しないように言われる必要があるからです。

関連する動きとして、Googleは新しいFairwindプログラムとともにGemini 3.8 Flash Cyberをリリースしました。これは厳密に政府と「信頼できるパートナー」向けです。CrowdStrikeやCenter for Internet Securityを含む650のメンバーを誇るこのプログラムは、3.8 Flash Cyberと、脆弱性を自律的に発見して修正し、重要インフラ、公共サービス、国家安全保障を保護できるGoogleのCodeMenderエージェントへのアクセスを提供します。政府承認のサイバーAIほど「信頼できるパートナー」を意味するものはありません。

Gemini 3.8 Flashは、Google AI ProまたはUltraサブスクリプションを持つ消費者、および開発者とエンタープライズユーザーが今すぐ利用できます。あなたのAIがより懸命に働く(そしておそらくより多く請求する)準備ができているなら、アップグレードの時です。