DeepSeek V4: Il Modello Open Source Più Economico, Più Lungo, e Forse Alimentato da Huawei
Il modello V4 di DeepSeek è più economico, più intelligente e con un contesto più lungo che mai - e potrebbe aiutare la Cina a abbandonare Nvidia per Huawei, un token alla volta.
Il 24 aprile, la società cinese di IA DeepSeek ha rilasciato V4, il suo nuovo modello di punta tanto atteso, e onestamente, è un bel colpo - anche se non scuoterà il mondo dell'IA come ha fatto il suo predecessore R1. V4 può elaborare prompt molto più lunghi grazie a un nuovo design ingegnoso, è open source (quindi chiunque può scaricarlo, usarlo e modificarlo), e sta facendo rumore per ragioni che vanno oltre i benchmark.
Prima di tutto, il prezzo. DeepSeek afferma che le prestazioni di V4 rivaleggiano con i migliori modelli a una frazione del costo, il che è una grande notizia per gli sviluppatori che non vogliono ipotecare le loro startup per pagare l'IA. V4 è disponibile in due versioni: V4-Pro, un modello più robusto per la codifica e compiti complessi, e V4-Flash, una versione più piccola e veloce. Entrambi hanno modalità di ragionamento che permettono al modello di mostrare il suo lavoro, come un insegnante di matematica a cui importa davvero. Prezzi? V4-Pro costa $1,74 per milione di token di input e $3,48 per milione di token di output - noccioline rispetto a OpenAI e Anthropic. V4-Flash è ancora più economico, a circa $0,14 per milione di token di input e $0,28 per milione di token di output, rendendolo uno dei modelli di fascia alta più economici in circolazione. È il tipo di prezzo che ti fa venire voglia di creare un'app solo perché puoi.
Dal punto di vista delle prestazioni, V4 è un salto enorme rispetto a R1, il che è circa sorprendente quanto scoprire che l'acqua è bagnata. Sui principali benchmark, V4-Pro eguaglia Anthropic's Claude-Opus-4.6, OpenAI's GPT-5.4, e Google's Gemini-3.1, e batte rivali open source come Alibaba's Qwen-3.5 e Z.ai's GLM-5.1 su codifica, matematica e problemi STEM. È anche un asso nei compiti di codifica agentica e nella risoluzione di problemi in più passaggi. Il sondaggio interno di DeepSeek su 85 sviluppatori? Più del 90% ha messo V4-Pro tra le loro scelte migliori per la codifica. E per la folla agentica, V4 è ottimizzato per framework come Claude Code, OpenClaw e CodeBuddy - perché chi non vuole che la propria IA abbia un compagno?
Ora, la questione del contesto lungo. Entrambe le versioni di V4 possono gestire 1 milione di token - abbastanza per contenere tutti e tre i volumi de Il Signore degli Anelli e Lo Hobbit messi insieme. Sono un sacco di hobbit. Ma la vera innovazione è come DeepSeek l'ha fatto: hanno modificato il meccanismo di attenzione per essere più selettivo, comprimendo le informazioni più vecchie e concentrandosi su ciò che conta ora. Questo riduce la potenza di calcolo al 27% e la memoria al 10% rispetto al precedente modello V3.2 in un contesto di 1 milione di token (V4-Flash usa solo il 10% del calcolo e il 7% della memoria). Ciò significa che puoi costruire un assistente di codifica IA che legge l'intero codebase senza dimenticare ciò che ha letto cinque minuti fa.
E ora la geopolitica. V4 è il primo modello di DeepSeek ottimizzato per chip cinesi domestici, in particolare Huawei's Ascend. Questo è un grosso problema perché è un test per vedere se la Cina può svezzarsi da Nvidia. I controlli all'esportazione degli Stati Uniti hanno tagliato fuori le aziende cinesi dai migliori chip di Nvidia, quindi Pechino sta spingendo per uno stack IA fatto in casa. DeepSeek avrebbe dato accesso anticipato solo ai produttori di chip cinesi, e Huawei ha annunciato venerdì che i suoi supernodi Ascend 950 supporteranno V4. Ma non corriamo troppo: il rapporto tecnico di DeepSeek suggerisce che stanno usando chip cinesi per l'inferenza, ma l'addestramento potrebbe ancora dipendere da Nvidia. Il professor Liu Zhiyuan di Tsinghua ha detto a MIT Technology Review che solo una parte dell'addestramento di V4 è stata adattata per chip cinesi, e multiple fonti anonime hanno detto che i chip cinesi sono migliori per l'inferenza che per l'addestramento. Tuttavia, DeepSeek afferma che i prezzi di V4-Pro potrebbero scendere significativamente una volta che i supernodi Ascend 950 di Huawei saranno spediti su larga scala nella seconda metà di quest'anno.
Quindi, V4 scuoterà le cose come R1? Probabilmente no, ma è un segno che la Cina sta costruendo un'infrastruttura IA parallela - e lo fa con un prezzo che ti farà fare un doppio giro.
The Good Times
Notizie nella tua casella.
Un riepilogo sardonico, consegnato secondo il tuo programma. Gratis. Annulla quando vuoi.
Già iscritto ma non arriviamo mai nella tua casella? Controlla la cartella spam e premi 'Non è spam' (o 'Rimuovi dallo spam') per tirarci fuori dal purgatorio della posta indesiderata. Aiuterai anche tutti gli altri.
Se non apri nessuna delle nostre email per un mese, verrai rimosso automaticamente dalla lista.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.