DeepSeek V4: O Modelo Open Source Mais Barato, Mais Longo e Talvez Até com Potência da Huawei
O modelo V4 da DeepSeek é mais barato, mais inteligente e com contexto mais longo do que nunca - e pode ajudar a China a abandonar a Nvidia pela Huawei, um token de cada vez.
Em 24 de abril, a empresa chinesa de IA DeepSeek lançou o V4, seu novo modelo principal tão aguardado, e sinceramente, é um grande negócio - mesmo que não abale o mundo da IA como seu antecessor R1 fez. O V4 pode processar prompts muito mais longos graças a um novo design engenhoso, é open source (então qualquer um pode baixar, usar e modificar), e está fazendo barulho por razões que vão além dos benchmarks.
Primeiro, o preço. A DeepSeek afirma que o desempenho do V4 rivaliza com os melhores modelos a uma fração do custo, o que é ótimo para desenvolvedores que não querem hipotecar suas startups para pagar por IA. O V4 vem em duas versões: V4-Pro, um modelo mais robusto para codificação e tarefas complexas, e V4-Flash, uma versão menor e mais rápida. Ambos têm modos de raciocínio que permitem ao modelo mostrar seu trabalho, como um professor de matemática que realmente se importa. Preços? O V4-Pro cobra $1,74 por milhão de tokens de entrada e $3,48 por milhão de tokens de saída - fichinha comparado à OpenAI e Anthropic. O V4-Flash é ainda mais barato, cerca de $0,14 por milhão de tokens de entrada e $0,28 por milhão de tokens de saída, tornando-o um dos modelos de ponta mais baratos por aí. Esse é o tipo de preço que faz você querer criar um aplicativo só porque pode.
Em termos de desempenho, o V4 é um salto massivo em relação ao R1, o que é tão surpreendente quanto descobrir que água é molhada. Em benchmarks importantes, o V4-Pro iguala o Claude-Opus-4.6 da Anthropic, o GPT-5.4 da OpenAI e o Gemini-3.1 do Google, e supera rivais open source como Qwen-3.5 da Alibaba e GLM-5.1 da Z.ai em codificação, matemática e problemas STEM. Também é nota 10 em tarefas de codificação agêntica e resolução de problemas em várias etapas. A pesquisa interna da DeepSeek com 85 desenvolvedores? Mais de 90% colocaram o V4-Pro entre suas principais escolhas para codificação. E para o público agêntico, o V4 é otimizado para frameworks como Claude Code, OpenClaw e CodeBuddy - porque quem não quer que sua IA tenha um parceiro?
Agora, a questão do contexto longo. Ambas as versões do V4 podem lidar com 1 milhão de tokens - o suficiente para caber todos os três volumes de O Senhor dos Anéis e O Hobbit combinados. Isso é muito hobbit. Mas a verdadeira inovação é como a DeepSeek fez isso: eles ajustaram o mecanismo de atenção para ser mais seletivo, comprimindo informações antigas e focando no que importa agora. Isso reduz o poder computacional para 27% e a memória para 10% em comparação com o modelo anterior V3.2 em um contexto de 1 milhão de tokens (o V4-Flash usa apenas 10% do poder computacional e 7% da memória). Isso significa que você pode construir um assistente de codificação de IA que lê todo o seu código sem esquecer o que leu cinco minutos atrás.
E agora a geopolítica. O V4 é o primeiro modelo da DeepSeek otimizado para chips chineses domésticos, especificamente o Ascend da Huawei. Isso é um grande negócio porque é um teste de se a China pode se livrar da Nvidia. Os controles de exportação dos EUA cortaram o acesso das empresas chinesas aos melhores chips da Nvidia, então Pequim está pressionando por uma pilha de IA doméstica. A DeepSeek supostamente deu acesso antecipado apenas a fabricantes de chips chineses, e a Huawei anunciou na sexta-feira que seus supernós Ascend 950 suportarão o V4. Mas não vamos nos adiantar: o relatório técnico da DeepSeek sugere que eles estão usando chips chineses para inferência, mas o treinamento ainda pode depender da Nvidia. O professor da Tsinghua, Liu Zhiyuan, disse à MIT Technology Review que apenas parte do treinamento do V4 foi adaptada para chips chineses, e várias fontes anônimas disseram que chips chineses são melhores para inferência do que para treinamento. Ainda assim, a DeepSeek diz que os preços do V4-Pro podem cair significativamente quando os supernós Ascend 950 da Huawei forem enviados em escala no segundo semestre deste ano.
Então, o V4 vai abalar as estruturas como o R1? Provavelmente não, mas é um sinal de que a China está construindo uma infraestrutura de IA paralela - e fazendo isso com um preço que fará você olhar duas vezes.
The Good Times
Notícias na sua caixa.
Um resumo sardônico, entregue conforme sua agenda. Grátis. Cancele quando quiser.
Já está inscrito mas nunca chegamos à sua caixa de entrada? Veja a pasta de spam e clique em 'Não é spam' (ou 'Remover do spam') para nos tirar do purgatório do lixo eletrônico. De quebra, ajuda todo mundo.
Se você não abrir nenhum dos nossos e-mails por um mês, será removido automaticamente da lista.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.