Pe 24 aprilie, firma chineză de AI DeepSeek a lansat V4, mult așteptatul său nou model emblematic, și, sincer, e o afacere destul de mare - chiar dacă nu va zgudui lumea AI chiar ca predecesorul său R1. V4 poate procesa prompt-uri mult mai lungi datorită unui design ingenios, e open source (deci oricine îl poate descărca, folosi și modifica), și face zgomot din motive care depășesc simplele benchmark-uri.

În primul rând, prețul. DeepSeek susține că performanța V4 rivalizează cu cele mai bune modele la o fracțiune din cost, ceea ce e o veste grozavă pentru dezvoltatorii care nu vor să-și ipotecheze startup-urile pentru a plăti pentru AI. V4 vine în două variante: V4-Pro, un model mai robust pentru codare și sarcini complexe, și V4-Flash, o versiune mai mică și mai rapidă. Ambele au moduri de raționament care permit modelului să-și arate munca, ca un profesor de matematică căruia chiar îi pasă. Prețuri? V4-Pro costă 1,74 dolari per milion de token-uri de intrare și 3,48 dolari per milion de token-uri de ieșire - bani de buzunar comparativ cu OpenAI și Anthropic. V4-Flash e și mai ieftin, la aproximativ 0,14 dolari per milion de token-uri de intrare și 0,28 dolari per milion de token-uri de ieșire, făcându-l unul dintre cele mai ieftine modele de top. Acesta e genul de preț care te face să vrei să construiești o aplicație doar pentru că poți.

În ceea ce privește performanța, V4 e un salt masiv față de R1, ceea ce e la fel de surprinzător ca și cum ai descoperi că apa e udă. La benchmark-urile majore, V4-Pro se potrivește cu Claude-Opus-4.6 de la Anthropic, GPT-5.4 de la OpenAI și Gemini-3.1 de la Google, și bate rivalii open-source precum Qwen-3.5 de la Alibaba și GLM-5.1 de la Z.ai la codare, matematică și probleme STEM. E, de asemenea, excelent la sarcini de codare agentică și rezolvarea problemelor în mai mulți pași. Sondajul intern al DeepSeek cu 85 de dezvoltatori? Peste 90% au pus V4-Pro în topul alegerilor lor pentru codare. Și pentru publicul agentic, V4 e optimizat pentru framework-uri precum Claude Code, OpenClaw și CodeBuddy - pentru că cine nu-și dorește ca AI-ul său să aibă un partener?

Acum, partea cu contextul lung. Ambele versiuni V4 pot gestiona 1 milion de token-uri - suficient pentru a încăpea toate cele trei volume din Stăpânul Inelelor și Hobbitul la un loc. Asta înseamnă o mulțime de hobbiți. Dar adevărata inovație e cum a făcut DeepSeek asta: au modificat mecanismul de atenție pentru a fi mai selectiv, comprimând informațiile vechi și concentrându-se pe ceea ce contează acum. Asta reduce puterea de calcul la 27% și memoria la 10% comparativ cu modelul anterior V3.2 într-un context de 1 milion de token-uri (V4-Flash folosește doar 10% din calcul și 7% din memorie). Asta înseamnă că poți construi un asistent de codare AI care îți citește întregul codebase fără să uite ce a citit acum cinci minute.

Și acum geopolitica. V4 e primul model DeepSeek optimizat pentru cipuri chinezești domestice, în special Ascend de la Huawei. Asta e o afacere mare pentru că e un test dacă China se poate dezlipi de Nvidia. Controalele la export ale SUA au tăiat firmele chineze de la cele mai bune cipuri Nvidia, așa că Beijingul împinge pentru un stack AI autohton. DeepSeek ar fi dat acces timpuriu doar producătorilor chinezi de cipuri, iar Huawei a anunțat vineri că supernodurile sale Ascend 950 vor suporta V4. Dar să nu o luăm înainte: raportul tehnic al DeepSeek sugerează că folosesc cipuri chinezești pentru inferență, dar antrenamentul s-ar putea baza încă pe Nvidia. Profesorul de la Tsinghua, Liu Zhiyuan, a spus pentru MIT Technology Review că doar o parte din antrenamentul V4 a fost adaptată pentru cipuri chinezești, iar mai multe surse anonime au spus că cipurile chinezești sunt mai bune pentru inferență decât pentru antrenament. Totuși, DeepSeek spune că prețurile V4-Pro ar putea scădea semnificativ odată ce supernodurile Ascend 950 de la Huawei vor fi livrate la scară largă în a doua jumătate a acestui an.

Deci, va zgudui V4 lucrurile ca R1? Probabil că nu, dar e un semn că China construiește o infrastructură AI paralelă - și o face cu un preț care te va face să te uiți de două ori.