Em 24 de abril, a empresa chinesa de IA DeepSeek lançou o V4, seu novo modelo principal tão aguardado, e sinceramente, é um grande negócio - mesmo que não abale o mundo da IA como seu antecessor R1 fez. O V4 pode processar prompts muito mais longos graças a um novo design engenhoso, é open source (então qualquer um pode baixar, usar e modificar), e está fazendo barulho por razões que vão além dos benchmarks.

Primeiro, o preço. A DeepSeek afirma que o desempenho do V4 rivaliza com os melhores modelos a uma fração do custo, o que é ótimo para desenvolvedores que não querem hipotecar suas startups para pagar por IA. O V4 vem em duas versões: V4-Pro, um modelo mais robusto para codificação e tarefas complexas, e V4-Flash, uma versão menor e mais rápida. Ambos têm modos de raciocínio que permitem ao modelo mostrar seu trabalho, como um professor de matemática que realmente se importa. Preços? O V4-Pro cobra $1,74 por milhão de tokens de entrada e $3,48 por milhão de tokens de saída - fichinha comparado à OpenAI e Anthropic. O V4-Flash é ainda mais barato, cerca de $0,14 por milhão de tokens de entrada e $0,28 por milhão de tokens de saída, tornando-o um dos modelos de ponta mais baratos por aí. Esse é o tipo de preço que faz você querer criar um aplicativo só porque pode.

Em termos de desempenho, o V4 é um salto massivo em relação ao R1, o que é tão surpreendente quanto descobrir que água é molhada. Em benchmarks importantes, o V4-Pro iguala o Claude-Opus-4.6 da Anthropic, o GPT-5.4 da OpenAI e o Gemini-3.1 do Google, e supera rivais open source como Qwen-3.5 da Alibaba e GLM-5.1 da Z.ai em codificação, matemática e problemas STEM. Também é nota 10 em tarefas de codificação agêntica e resolução de problemas em várias etapas. A pesquisa interna da DeepSeek com 85 desenvolvedores? Mais de 90% colocaram o V4-Pro entre suas principais escolhas para codificação. E para o público agêntico, o V4 é otimizado para frameworks como Claude Code, OpenClaw e CodeBuddy - porque quem não quer que sua IA tenha um parceiro?

Agora, a questão do contexto longo. Ambas as versões do V4 podem lidar com 1 milhão de tokens - o suficiente para caber todos os três volumes de O Senhor dos Anéis e O Hobbit combinados. Isso é muito hobbit. Mas a verdadeira inovação é como a DeepSeek fez isso: eles ajustaram o mecanismo de atenção para ser mais seletivo, comprimindo informações antigas e focando no que importa agora. Isso reduz o poder computacional para 27% e a memória para 10% em comparação com o modelo anterior V3.2 em um contexto de 1 milhão de tokens (o V4-Flash usa apenas 10% do poder computacional e 7% da memória). Isso significa que você pode construir um assistente de codificação de IA que lê todo o seu código sem esquecer o que leu cinco minutos atrás.

E agora a geopolítica. O V4 é o primeiro modelo da DeepSeek otimizado para chips chineses domésticos, especificamente o Ascend da Huawei. Isso é um grande negócio porque é um teste de se a China pode se livrar da Nvidia. Os controles de exportação dos EUA cortaram o acesso das empresas chinesas aos melhores chips da Nvidia, então Pequim está pressionando por uma pilha de IA doméstica. A DeepSeek supostamente deu acesso antecipado apenas a fabricantes de chips chineses, e a Huawei anunciou na sexta-feira que seus supernós Ascend 950 suportarão o V4. Mas não vamos nos adiantar: o relatório técnico da DeepSeek sugere que eles estão usando chips chineses para inferência, mas o treinamento ainda pode depender da Nvidia. O professor da Tsinghua, Liu Zhiyuan, disse à MIT Technology Review que apenas parte do treinamento do V4 foi adaptada para chips chineses, e várias fontes anônimas disseram que chips chineses são melhores para inferência do que para treinamento. Ainda assim, a DeepSeek diz que os preços do V4-Pro podem cair significativamente quando os supernós Ascend 950 da Huawei forem enviados em escala no segundo semestre deste ano.

Então, o V4 vai abalar as estruturas como o R1? Provavelmente não, mas é um sinal de que a China está construindo uma infraestrutura de IA paralela - e fazendo isso com um preço que fará você olhar duas vezes.