DeepSeek ha vuelto a golpear. Y no lo ha hecho con un modelo revolucionario, sino con un precio que hace sangrar los ojos a la competencia: completar todas las pruebas del Intelligence Index de Artificial Analysis cuesta 0,03 dólares con V4-Flash. Cien veces menos que usar Claude Fable 5 de Anthropic, que se va a 3,15 dólares. ¿La pega? Que ser el más barato no te convierte en el más listo, y los números cuentan otra historia.
Céntimos contra dólares: la guerra de precios se pone fea
Las tarifas del nuevo modelo son de 0,14 dólares por cada millón de tokens de entrada y 0,28 por los de salida. Para que te hagas una idea, el mismo test de inteligencia cuesta 0,86 dólares con Kimi K3 de Moonshot, 1,86 con GPT-5.6 Sol de OpenAI y 3,15 con el citado Fable 5. V4-Flash es la versión ligera de la familia, pensada para tareas diarias de alto volumen, mientras que su hermano mayor, V4-Pro, está orientado al razonamiento complejo aunque aún no tiene fecha de lanzamiento oficial.
En cuanto a potencia bruta, cuenta con 284.000 millones de parámetros totales, pero solo activa 13.000 millones durante la inferencia. Ese es el primer truco para abaratar costes: mover menos piezas. La ventana de contexto alcanza el millón de tokens, y en los benchmarks rasca 50 puntos sobre 100 en el test de inteligencia de Artificial Analysis, el mismo resultado que Gemini 3.6 Flash de Google, y por detrás de Muse Spark 1.1 de Meta y GLM-5.2 de Z.ai, ambos con 51.
Es decir, llega al pelotón de cabeza de los modelos económicos, pero se queda a nueve puntos de las bestias como Claude Opus 5 o GPT-5.6. Nada mal para un modelo que te cuesta el café de la máquina del trabajo.
El coste por completar el índice con V4-Flash es tres céntimos. Cien veces menos que la opción más potente de Anthropic.
El truco está en lo que no cuenta: errores, alucinaciones y el coste real
Aquí empieza lo interesante. Porque la letra pequeña esconde un dato que cualquiera que confíe ciegamente en la IA debería tatuarse: el test AA-Omniscience de la misma firma revela que V4-Flash solo acierta el 37% de las veces en preguntas de conocimiento, con una tasa de alucinación del 84%. O sea, que tres de cada cuatro respuestas pueden ser inventos bonitos. Para tareas críticas sin supervisión humana, este modelo es un volante en manos de un mono.
La bajada de precio tiene truco, y la fiabilidad se paga con errores que luego hay que corregir a mano. Forbes ya lo advierte: los retrasos, la supervisión extra y la pérdida de confianza del usuario también suman en la factura final. Entre tanto, DeepSeek se prepara para una posible salida a bolsa y necesita recuperar el protagonismo que perdió tras agitar el mercado con R1 en 2025. La jugada es clara: presionar los precios del sector mientras los laboratorios chinos y estadounidenses se pelean por cada céntimo. De hecho, pese a que OpenAI ha recortado hasta un 80% el coste de GPT-5.6, el modelo chino sigue siendo un 60% más barato para tareas equivalentes.
Y por si no hubiera suficiente salsa, un día después Alibaba lanzó Qwen3.8-Max, otro aspirante a reventar la barra de precios. Cosas de la vida.
Una lección que ya aprendimos (pero se nos olvida)
No es la primera vez que DeepSeek nos obliga a mirar la relación calidad-precio con lupa. Aquel R1 de principios de 2025 ya demostró que se puede entrenar un modelo puntero gastando la mitad que los americanos, y el sector entró en pánico. Ahora repite la fórmula pero con un matiz: aquí no se compite por ser el mejor, sino por ser el más barato dentro de lo aceptable. La cuestión es si tu proyecto puede permitirse un 84% de alucinaciones. Para chatbots de atención al cliente que solo dicen “su consulta ha sido registrada”, igual sí. Para un resumen financiero o un diagnóstico médico asistido, mejor llama a un humano.
El ahorro en tokens se esfuma si luego tienes que pagar dos horas de ingeniero revisando los disparates del modelo. Esa es la verdad incómoda que ningún laboratorio va a imprimir en el cartel de rebajas. Al final, el equilibrio entre precio y capacidades sigue siendo el Santo Grial, y herramientas como el Intelligence Index sirven para poner los números sobre la mesa antes de firmar cheques.
Hype-O-Meter
Nivel de hype: 6,5/10. El precio es un escándalo y los benchmarks le dan un aprobado justo, pero las alucinaciones son un lastre demasiado pesado para cualquier uso serio. V4-Flash es un utilitario maquillado de Fórmula 1 — y el motor, de serie, viene gripado.
El resumen para vagos (TL;DR)
- 🎯 ¿Qué ha pasado? DeepSeek lanza V4-Flash, el modelo de IA más barato del mercado, 100 veces más económico que Claude Fable 5.
- 🔥 ¿Por qué importa? La guerra de precios de la IA se recrudece mientras la fiabilidad del modelo deja mucho que desear (84% de alucinaciones).
- 🤔 ¿Nos afecta o es solo un meme? Si no tienes un equipo que supervise sus respuestas, el ahorro puede acabar costándote caro.



