DeepSeek V4: el modelo de código abierto más grande del mundo, a un precio que rompe el mercado

DeepSeek V4 es el modelo de código abierto más grande del mundo, con 671B de parámetros. Su precio por token es 34 veces menor que GPT-5.5. Te contamos qué hay detrás del modelo que está reventando el mercado.

DeepSeek V4 es el modelo de código abierto más grande del mundo, con 671.000 millones de parámetros totales y 37.000 millones activados por cada token, según su paper técnico. Su precio por token de salida es una fracción del de GPT-5.5 y modelos similares de la competencia.

Para lograr inference eficiente y entrenamiento económico, DeepSeek V4 adopta Multi-head Latent Attention (MLA) y arquitecturas DeepSeekMoE, validadas previamente en DeepSeek V2. Además, introduce una estrategia auxiliary-loss-free para balanceo de carga y un objetivo de multi-token prediction para mayor rendimiento.

El modelo se preentrena con un dataset de 14,8 billones de tokens, siguiendo un proceso de dos fases que incluye un preentrenamiento general y un preentrenamiento específico con más supervisión. El resultado es un modelo que rivaliza en calidad con los mejores modelos cerrados a una fracción del coste.

El lanzamiento de DeepSeek V4 ha provocado una reestrcuturación de precios en el mercado de APIs de modelos de lenguaje. Según datos de la plataforma Apidog, el precio por millón de tokens de salida de DeepSeek V4 es aproximadamente 34 veces menor que GPT-5.5, mientras el rendimiento en benchmarks de codificación y razonamiento se sitúa en torno al 95% del de GPT-5.5.

Para los desarrolladores, esto cambia los cálculos de coste para cualquier aplicación que haga llamadas frecuentes a LLMs. La diferencia entre $3,48 y $0,87 por millón de tokens de salida se traduce directamente en facturas mensuales radicalmente diferentes a escala.