DeepSeek V4: El modelo de código abierto que es más barato, más largo y quizás impulsado por Huawei
El modelo V4 de DeepSeek es más barato, más inteligente y con contexto más largo que nunca, y podría ayudar a China a dejar a Nvidia por Huawei, token a token.
El 24 de abril, la empresa china de IA DeepSeek lanzó V4, su nuevo modelo insignia largamente esperado, y sinceramente, es un gran acontecimiento, aunque no sacudirá el mundo de la IA tanto como su predecesor R1. V4 puede procesar prompts mucho más largos gracias a un diseño novedoso, es de código abierto (así que cualquiera puede descargarlo, usarlo y modificarlo), y está dando que hablar por razones que van más allá de los benchmarks.
Primero, el precio. DeepSeek afirma que el rendimiento de V4 rivaliza con los mejores modelos a una fracción del costo, lo cual es una gran noticia para los desarrolladores que no quieren hipotecar sus startups para pagar por IA. V4 viene en dos versiones: V4-Pro, un modelo más robusto para codificación y tareas complejas, y V4-Flash, una versión más pequeña y rápida. Ambos tienen modos de razonamiento que permiten al modelo mostrar su trabajo, como un profesor de matemáticas que realmente se preocupa. ¿Precios? V4-Pro cobra $1.74 por millón de tokens de entrada y $3.48 por millón de tokens de salida, una miseria comparado con OpenAI y Anthropic. V4-Flash es aún más barato, con alrededor de $0.14 por millón de tokens de entrada y $0.28 por millón de tokens de salida, convirtiéndolo en uno de los modelos de primer nivel más económicos. Ese es el tipo de precio que te dan ganas de crear una aplicación solo porque puedes.
En cuanto al rendimiento, V4 es un salto masivo respecto a R1, lo cual es tan sorprendente como descubrir que el agua moja. En los principales benchmarks, V4-Pro iguala a Claude-Opus-4.6 de Anthropic, GPT-5.4 de OpenAI y Gemini-3.1 de Google, y supera a rivales de código abierto como Qwen-3.5 de Alibaba y GLM-5.1 de Z.ai en codificación, matemáticas y problemas STEM. También es excelente en tareas de codificación agéntica y resolución de problemas de múltiples pasos. ¿La encuesta interna de DeepSeek a 85 desarrolladores? Más del 90% puso a V4-Pro entre sus mejores opciones para codificación. Y para el público agéntico, V4 está optimizado para frameworks como Claude Code, OpenClaw y CodeBuddy, porque ¿quién no quiere que su IA tenga un compañero?
Ahora, lo del contexto largo. Ambas versiones de V4 pueden manejar 1 millón de tokens, suficiente para caber los tres volúmenes de El Señor de los Anillos y El Hobbit combinados. Eso es un montón de hobbits. Pero la verdadera innovación es cómo lo hizo DeepSeek: ajustaron el mecanismo de atención para que sea más selectivo, comprimiendo información antigua y enfocándose en lo que importa ahora. Esto reduce el poder de cómputo al 27% y la memoria al 10% en comparación con el modelo anterior V3.2 en un contexto de 1 millón de tokens (V4-Flash usa solo el 10% de cómputo y el 7% de memoria). Eso significa que puedes construir un asistente de codificación con IA que lea todo tu código base sin que olvide lo que leyó hace cinco minutos.
Y ahora, la geopolítica. V4 es el primer modelo de DeepSeek optimizado para chips chinos domésticos, específicamente el Ascend de Huawei. Esto es un gran problema porque es una prueba de si China puede destetarse de Nvidia. Los controles de exportación de EE. UU. han cortado a las empresas chinas de los mejores chips de Nvidia, por lo que Beijing está impulsando una pila de IA nacional. Según informes, DeepSeek dio acceso temprano solo a fabricantes de chips chinos, y Huawei anunció el viernes que sus supernodos Ascend 950 soportarán V4. Pero no nos adelantemos: el informe técnico de DeepSeek sugiere que están usando chips chinos para inferencia, pero el entrenamiento puede seguir dependiendo de Nvidia. El profesor de Tsinghua Liu Zhiyuan dijo a MIT Technology Review que solo parte del entrenamiento de V4 se adaptó a chips chinos, y múltiples fuentes anónimas dijeron que los chips chinos son mejores para inferencia que para entrenamiento. Aún así, DeepSeek dice que los precios de V4-Pro podrían caer significativamente una vez que los supernodos Ascend 950 de Huawei se envíen a escala en la segunda mitad de este año.
Entonces, ¿V4 sacudirá las cosas como R1? Probablemente no, pero es una señal de que China está construyendo una infraestructura de IA paralela, y lo está haciendo con un precio que te hará mirar dos veces.
The Good Times
Noticias en tu bandeja.
Un resumen sardónico, entregado según tu horario. Gratis. Cancela cuando tu tolerancia al ingenio se agote.
¿Ya estás suscrito pero nunca llegamos a tu bandeja? Revisa la carpeta de spam y pulsa 'No es spam' (o 'Quitar de spam') para rescatarnos del purgatorio del correo basura. De paso ayudas a todos los demás.
Si no abres ninguno de nuestros correos durante un mes, se te eliminará automáticamente de la lista.
Rewrite Article
Select parts to regenerate with a fresh AI pass. Translations will be updated automatically.
Generate AI Image
Creates a sardonic version of the article image using OpenAI.