Op 24 april lanceerde het Chinese AI-bedrijf DeepSeek V4, het langverwachte nieuwe vlaggenschipmodel, en eerlijk gezegd is het een behoorlijk grote deal - ook al zal het de AI-wereld niet zo doen schudden als zijn voorganger R1 deed. V4 kan veel langere prompts verwerken dankzij een handig nieuw ontwerp, het is open source (dus iedereen kan het downloaden, gebruiken en aanpassen), en het maakt lawaai om redenen die verder gaan dan alleen benchmarks.

Ten eerste, de prijs. DeepSeek beweert dat de prestaties van V4 wedijveren met de beste modellen tegen een fractie van de kosten, wat geweldig nieuws is voor ontwikkelaars die hun startups niet willen verhypotheken om AI te betalen. V4 komt in twee smaken: V4-Pro, een krachtiger model voor coderen en complexe taken, en V4-Flash, een kleinere, snellere versie. Beide hebben redeneermodi waarmee het model zijn werk kan tonen, zoals een wiskundeleraar die echt om je geeft. Prijzen? V4-Pro kost $1,74 per miljoen invoertokens en $3,48 per miljoen uitvoertokens - peanuts vergeleken met OpenAI en Anthropic. V4-Flash is zelfs goedkoper met ongeveer $0,14 per miljoen invoertokens en $0,28 per miljoen uitvoertokens, waardoor het een van de goedkoopste topmodellen is. Dat is het soort prijskaartje dat je een app wilt laten bouwen gewoon omdat het kan.

Qua prestaties is V4 een enorme sprong ten opzichte van R1, wat ongeveer zo verrassend is als ontdekken dat water nat is. Op belangrijke benchmarks evenaart V4-Pro Anthropic's Claude-Opus-4.6, OpenAI's GPT-5.4 en Google's Gemini-3.1, en het verslaat open-source rivalen zoals Alibaba's Qwen-3.5 en Z.ai's GLM-5.1 op coderen, wiskunde en STEM-problemen. Het is ook uitblinker in agentische codetaken en meerstaps probleemoplossing. DeepSeeks interne enquête onder 85 ontwikkelaars? Meer dan 90% plaatste V4-Pro in hun topkeuzes voor coderen. En voor de agentische menigte is V4 geoptimaliseerd voor frameworks zoals Claude Code, OpenClaw en CodeBuddy - want wie wil niet dat zijn AI een sidekick heeft?

Nu het lange-context-gedoe. Beide V4-versies kunnen 1 miljoen tokens aan - genoeg om alle drie de delen van In de Ban van de Ring en De Hobbit samen te bevatten. Dat is veel hobbits. Maar de echte innovatie is hoe DeepSeek het deed: ze pasten het aandachtsmechanisme aan om selectiever te zijn, oudere informatie te comprimeren en te focussen op wat nu belangrijk is. Dit vermindert de rekenkracht tot 27% en het geheugen tot 10% vergeleken met het vorige model V3.2 in een context van 1 miljoen tokens (V4-Flash gebruikt slechts 10% van de rekenkracht en 7% van het geheugen). Dat betekent dat je een AI-codeerassistent kunt bouwen die je hele codebase leest zonder te vergeten wat het vijf minuten geleden las.

En nu de geopolitiek. V4 is DeepSeeks eerste model geoptimaliseerd voor binnenlandse Chinese chips, specifiek Huawei's Ascend. Dit is een grote deal omdat het een test is of China zich van Nvidia kan afkeren. Amerikaanse exportcontroles hebben Chinese bedrijven afgesneden van Nvidia's beste chips, dus Peking dringt aan op een eigen AI-stack. DeepSeek gaf naar verluidt alleen vroege toegang aan Chinese chipmakers, en Huawei kondigde vrijdag aan dat zijn Ascend 950 supernodes V4 zullen ondersteunen. Maar laten we niet op de zaken vooruitlopen: DeepSeeks technisch rapport suggereert dat ze Chinese chips gebruiken voor inferentie, maar training kan nog steeds afhankelijk zijn van Nvidia. Tsinghua-professor Liu Zhiyuan vertelde MIT Technology Review dat slechts een deel van V4's training was aangepast voor Chinese chips, en meerdere anonieme bronnen zeiden dat Chinese chips beter zijn voor inferentie dan training. Toch zegt DeepSeek dat V4-Pro-prijzen aanzienlijk kunnen dalen zodra Huawei's Ascend 950 supernodes op schaal worden verzonden in de tweede helft van dit jaar.

Dus, zal V4 de boel opschudden zoals R1? Waarschijnlijk niet, maar het is een teken dat China een parallelle AI-infrastructuur aan het bouwen is - en dat doet het met een prijskaartje dat je doet dubbel nemen.