Google ha scatenato Gemini 3.8 Flash sul mondo, a poche settimane di distanza dal suo predecessore, perché lasciare che un perfetto schema di denominazione prenda polvere? L'azienda sostiene che questo nuovo modello "lavora di più" rispetto a Gemini 3.7 Flash - presumibilmente facendo nottate e svolgendo passaggi di ragionamento extra su compiti complessi mentre "chiama strumenti in modo iterativo", il che sembra estenuante.

Ma ecco il colpo di scena: nonostante mantenga gli stessi prezzi introduttivi di 3.7 Flash - $0,75 per milione di token di input e $3,75 per milione di token di output - questo piccolo modello industrioso potrebbe comunque finire per costarti di più. Google avverte, con la sottigliezza di uno schiaffo sulla fronte, che "il modello potrebbe usare più token per massimizzare le prestazioni, specialmente a livelli di sforzo più elevati". Quindi è come un appaltatore che fa pagare la stessa tariffa oraria ma improvvisamente impiega il doppio del tempo perché è davvero impegnato a fare un lavoro accurato. Gli sviluppatori che preferiscono che la loro IA sia più un genio pigro possono attenersi a Gemini 3.7 Flash per mantenere basso l'uso di token.

Le prime impressioni stanno arrivando e sono un misto di elogi e calcoli. Artificial Analysis ha fatto i conti e ha dichiarato Gemini 3.8 Flash "il più economico che abbiamo misurato a questo livello di intelligenza", ma poi ha lasciato cadere la bomba: "Questo è in aumento di circa il 40% rispetto a Gemini 3.7 Flash nonostante il prezzo per token invariato, guidato da un aumento del 30% dei token di output per attività e più turni nelle valutazioni agente". Quindi è più economico per punto di QI, ma stai pagando di più per attività perché non riesce proprio a smettere di chiacchierare.

Il CEO di Aigora.ai, John Ennis, è positivamente euforico, paragonando Gemini 3.8 Flash ai modelli di Anthropic: "Qualità di codifica Opus 5 ma a una frazione del costo e super veloce". Aggiunge: "Sarà fantastico per cose come creare video remotion". Prendiamo la sua parola.

Google vanta "miglioramenti significativi" per l'ingegneria del software e gli agenti AI autonomi. Sul benchmark di ingegneria del software DeepSWE v1.1, ha superato il suo predecessore e altri modelli all'avanguardia, incluso Fable 5 di Anthropic - che ha ricevuto un aggiornamento all'inizio di questa settimana che promette anche prestazioni più forti a un prezzo inferiore, tagliando il prezzo per l'uso di dati memorizzati nella cache. È una vera e propria corsa agli armamenti di superamento AI.

Il nuovo modello ha anche rivendicato la vittoria sul benchmark Vals Finance Agent V2 e sul benchmark Harvey's Legal Agent. Ma per non pensare che sia tutto divertimento e giochi, Google nota che Gemini 3.8 Flash "viene fornito con salvaguardie contro l'uso improprio nei settori chimico, biologico, radiologico e nucleare (CBRN) e offensiva informatica". Perché anche l'IA che lavora sodo deve essere detto di non costruire un'arma biologica.

In una mossa correlata, Google ha rilasciato Gemini 3.8 Flash Cyber insieme al suo nuovo programma Fairwind, che è strettamente per governi e "partner fidati". Il programma, che vanta 650 membri tra cui CrowdStrike e il Center for Internet Security, offre accesso a 3.8 Flash Cyber e all'agente CodeMender di Google, che può "trovare e correggere autonomamente le vulnerabilità, proteggendo le infrastrutture critiche, i servizi pubblici e la sicurezza nazionale". Perché nulla dice "partner fidato" come un'IA informatica approvata dal governo.

Gemini 3.8 Flash è disponibile ora per i consumatori con un abbonamento Google AI Pro o Ultra, così come per sviluppatori e utenti aziendali. Quindi, se sei pronto per la tua IA a lavorare di più (e possibilmente a farti pagare di più), è il momento di aggiornare.