I giganti dell'AI annunciano nuovi modelli che costano meno, fanno leggermente di più e decisamente non sono in panico per i rivali a basso costo
OpenAI e Anthropic rilasciano nuovi modelli che costano meno e fanno leggermente di più, perché competere con alternative open-weight economiche è apparentemente la nuova frontiera.
In una mossa che non sorprenderà assolutamente nessuno che abbia osservato l'inarrestabile marcia dell'industria dell'AI verso "più economico, più veloce, abbastanza buono", sia OpenAI che Anthropic hanno lanciato nuovi modelli puntati dritti al tuo portafoglio - o, più precisamente, al portafoglio del tuo dipartimento acquisti aziendale. Anthropic ha annunciato Opus 5.5, l'ultima versione del suo cavallo di battaglia per il coding e il lavoro conoscitivo complesso. OpenAI ha risposto con GPT-6 Sol e Luna, i suoi modelli intermedi e più piccoli focalizzati sull'efficienza. Nessuno dei due rilasci promette capacità rivoluzionarie. Invece, sono tutti all'insegna dell'efficienza, perché niente dice "innovazione all'avanguardia" come una corsa al ribasso sul prezzo.
Poiché entrambe le aziende si rivolgono ai clienti aziendali, sentono il fiato sul collo dei modelli open-weight. Le organizzazioni hanno iniziato a esplorare router di modelli e a cambiare le loro pratiche per usare meno spesso questi costosi modelli di frontiera, optando per alternative più economiche. Così Anthropic e OpenAI stanno facendo ciò che farebbe qualsiasi azienda razionale di fronte alla concorrenza: sostenere che i loro nuovi rilasci spingono l'involucro della frontiera (modestamente, sia chiaro) mentre riducono sostanzialmente i costi. È l'equivalente AI di un produttore di auto di lusso che improvvisamente offre una berlina economica e insiste che ha ancora quel tocco premium.
Opus 5.5 si colloca all'estremità superiore dei modelli annunciati oggi, ma siamo onesti: Anthropic sta un po' recuperando terreno rispetto a OpenAI. All'inizio di questo mese, OpenAI ha rilasciato GPT-6 Astra, che a volte batte modestamente Opus 5 nei benchmark e nel sentiment degli utenti. Per prezzo e capacità, Astra compete sia con Opus che con Fable. I benchmark di Anthropic e dei suoi partner ora mostrano Opus 5.5 performante meglio nel coding e nel lavoro conoscitivo rispetto a GPT-6 Astra in alcuni casi - anche se modestamente, perché non possiamo avere nulla di troppo drammatico.
La vera storia qui è il costo. Dall'annuncio di Anthropic: "I token di input e output sono $4 e $20 per milione, il 20% in meno rispetto a Opus 5. Le letture della cache (che costituiscono la maggior parte dei costi di lavoro agentico e di coding) sono $0,20 per milione di token, il 60% in meno rispetto a Opus 5. Opus 5.5 genera anche output più del 30% più velocemente di Opus 5." Anthropic sostiene inoltre risparmi vicini al 40 percento rispetto a Opus 5 per carichi di lavoro tipici con impostazioni predefinite, perché oltre ai costi dei token che scendono, Opus 5.5 utilizza meno token quando completa le attività. È come un doppio coupon sconto, ma per la tua bolletta AI.
Si dice che Opus 5.5 sia notevolmente capace in "aree ad alto rischio" come la cybersecurity e la biologia, quindi le stesse protezioni che si applicavano a Fable 5.1 si applicheranno anche qui. Le tue richieste potrebbero essere automaticamente e trasparentemente indirizzate a un modello più vecchio se vengono segnalate come se stessero sconfinando in territorio protetto. Perché niente dice "all'avanguardia" come essere silenziosamente declassati al modello dell'anno scorso quando chiedi di ricerca sul gain-of-function.
I GPT-6 Sol e Luna di OpenAI sono un passo avanti iterativo. Non molto tempo fa, l'azienda ha introdotto la sua convenzione di denominazione Sol, Terra, Luna per la famiglia di modelli GPT-5.6. Più recentemente - proprio questo mese - ha introdotto GPT-6 Astra, il suo modello più avanzato e potente. Potrebbe non essere ovvio cosa significhino quei nomi, quindi ecco il riepilogo rapido: Astra è il modello più aggressivamente potente (e costoso), pensato per coding e ricerca pesanti. Sol è un'alternativa capace ma più efficiente e conveniente - l'auto quotidiana. Terra è il modello equilibrato per uso generale. E Luna è l'opzione veloce ed economica. Potresti approssimativamente posizionare Astra contro Fable di Anthropic, Sol contro Opus, Terra contro Sonnet e Luna contro Haiku, ma è una mappatura imperfetta, specialmente per i modelli di fascia alta. Pensalo come un menu confuso dove tutto suona come un pianeta ma sa di quota di abbonamento.
OpenAI afferma che GPT-6 Sol e Luna sono stati addestrati con metodi simili a GPT-6 Astra. A seconda del benchmark, a volte sono qualche punto percentuale più capaci dei loro predecessori in certi compiti, ma costano la metà
The Good Times
Notizie nella tua casella.
Un riepilogo sardonico, consegnato secondo il tuo programma. Gratis. Annulla quando vuoi.
Già iscritto ma non arriviamo mai nella tua casella? Controlla la cartella spam e premi 'Non è spam' (o 'Rimuovi dallo spam') per tirarci fuori dal purgatorio della posta indesiderata. Aiuterai anche tutti gli altri.
Se non apri nessuna delle nostre email per un mese, verrai rimosso automaticamente dalla lista.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.