Mardi, Google DeepMind a publié Gemini 3.6 Flash, 3.5 Flash-Lite et 3.5 Flash Cyber. Gemini 3.6 Flash est le « modèle de travail » de Google qui promet des capacités améliorées en codage, travail de connaissance et performance multimodale tout en réduisant l'utilisation de tokens jusqu'à 17 %, le rendant moins cher que son prédécesseur 3.5 Flash.

Gemini 3.5 Flash-Lite est le modèle le plus rentable de sa catégorie, et 3.5 Flash Cyber est un modèle spécialisé affiné pour trouver et corriger les vulnérabilités de cybersécurité à un prix décent. Ce modèle sera exclusivement disponible pour les gouvernements et partenaires de confiance dans le cadre d'un programme pilote à accès limité, selon Google.

Google affirme que l'accent de ces versions est d'offrir efficacité, latence et fiabilité aux clients qui construisent des agents IA à grande échelle.

Ce lancement est notable non seulement pour ce que Google a livré — des modèles moins chers et plus rapides optimisés pour le codage, l'efficacité et la cybersécurité — mais aussi pour ce qu'il n'a pas livré. La mise à jour n'inclut pas la mise à jour tant attendue du modèle phare de Google, Gemini Pro, qui a été mis à jour pour la dernière fois en février.

Depuis ce lancement, OpenAI a publié GPT-5.5 et a commencé à déployer GPT-5.6, tandis qu'Anthropic a lancé Claude Opus 4.8 et Claude Sonnet 5 et a élargi l'accès à son modèle de pointe Fable 5, soulignant le rythme intense des versions des laboratoires concurrents.

Google avait teasé la sortie de Pro dans le cadre de la version 3.5 Flash en mai, disant que la version Pro était « déjà utilisée en interne, et nous avons hâte de la déployer le mois prochain. » La semaine dernière, Bloomberg a rapporté que Google faisait face à des retards internes dans le lancement du 3.5 Pro alors qu'il peinait à atteindre ses objectifs de performance internes.

Les modèles Gemini Pro sont généralement les offres les plus performantes de Google pour les tâches complexes de raisonnement et de codage, tandis que les modèles Flash privilégient un coût réduit et des temps de réponse plus rapides pour les applications de production.

Logan Kilpatrick, responsable produit chez Google DeepMind, a déclaré mardi que la société teste actuellement Gemini 3.5 Pro avec des partenaires et espère « atterrir bientôt. » Il a également noté que l'équipe a commencé sa session de pré-entraînement la plus ambitieuse à ce jour pour Gemini 4.