Volver a Novedades
Nueva featureDestacado25 de julio de 2026

DeepSeek V4 Pro y Flash: contexto de 1M al alcance de todos, ya en Napsix

DeepSeek lanzó V4 Pro (1.6T params) y V4 Flash (284B): ambos con 1M de contexto, open-weight y compatibles con las APIs de OpenAI y Anthropic. Hoy se apagan los alias legacy. Ya integrados en el AI Gateway.

aimodelosdeepseekv4open-source
DeepSeek V4 Pro y Flash: contexto de 1M al alcance de todos, ya en Napsix

DeepSeek lanzó su serie V4 (Pro + Flash) el 24 de abril de 2026 — ambos modelos open-source y con contexto de 1 millón de tokens — y hoy, 24 de julio, se apagan definitivamente los alias legacy deepseek-chat/deepseek-reasoner. Los dos modelos ya están integrados en el AI Gateway de Napsix.

DeepSeek V4: specs de la serie completa (Pro + Flash)

Dos tamaños, un mismo estándar de contexto

  • DeepSeek-V4-Pro: 1.6 billones de parámetros totales, 49 mil millones activados. Rinde a la par de los mejores modelos propietarios en coding agéntico (estado del arte open-source), lidera a todos los modelos abiertos en conocimiento general (solo detrás de Gemini 3.1 Pro) y supera a todos los modelos abiertos actuales en matemática/STEM/coding, rivalizando con los mejores modelos cerrados.
  • DeepSeek-V4-Flash: 284 mil millones de parámetros totales, 13 mil millones activados. Razonamiento casi al nivel de V4-Pro, rendimiento equivalente en tareas de agente simples, con respuestas más rápidas y el precio más bajo de la serie — ideal para tráfico de alto volumen.

DeepSeek V4-Pro: benchmarks de coding agéntico, conocimiento y razonamiento

Innovación estructural: 1M de contexto sin el costo habitual

Ambos modelos comparten la misma atención novedosa — compresión a nivel de token combinada con DSA (DeepSeek Sparse Attention) — lo que habilita 1M de contexto como estándar por defecto en todos los servicios oficiales de DeepSeek, con un costo de cómputo y memoria drásticamente menor que generaciones anteriores (DeepSeek-V3.2 y R1 topeaban en 128K-164K).

DeepSeek V4: eficiencia de contexto largo — el mismo costo de cómputo escala a 1M de tokens

Optimizaciones dedicadas para agentes

DeepSeek-V4 está integrado sin fricciones con agentes líderes como Claude Code, OpenClaw y OpenCode, y ya potencia el propio coding agéntico interno de DeepSeek. La imagen debajo muestra un ejemplo real: un PDF generado por DeepSeek-V4-Pro de punta a punta.

Ejemplo real: PDF generado de punta a punta por DeepSeek-V4-Pro

Compatibilidad de API

La API de DeepSeek expone ambos modelos con la misma URL base, compatible con la interfaz ChatCompletions de OpenAI y con la API de Anthropic — solo hay que cambiar el nombre del modelo a deepseek-v4-pro o deepseek-v4-flash. Ambos soportan modo pensamiento (thinking) y no-pensamiento (non-thinking) intercambiables por request.

Precio

DeepSeek V4: tabla de precios oficial por millón de tokens

ModeloEntrada (cache miss)Entrada (cache hit)Salida
V4-Pro$0.435/M$0.0036/M$0.87/M
V4-Flash$0.14/M$0.0028/M$0.28/M

(El precio promocional de 75% off sobre V4-Pro se volvió el precio oficial desde el 31 de mayo de 2026 — no es un descuento temporal. El precio de lista original era $1.74/$3.48 por millón.)

Aviso de deprecación

Los alias legacy deepseek-chat y deepseek-reasoner (que hasta hoy apuntaban a los modos non-thinking/thinking de V4-Flash) se retiran hoy, 24 de julio de 2026 a las 15:59 UTC. Cualquier integración que todavía use esos nombres debe migrar a deepseek-v4-pro / deepseek-v4-flash — el base_url no cambia, solo el parámetro model.

Open-weight

Los 4 checkpoints (V4-Pro, V4-Flash, y sus versiones base) están disponibles en Hugging Face bajo licencia abierta, con el reporte técnico completo publicado el mismo día del lanzamiento.

En Napsix

DeepSeek V4 Pro y Flash ya están activos en el catálogo de modelos de Napsix (servidos vía OpenRouter). Elegilos desde el selector de modelos del chat de XIA para trabajo de razonamiento profundo (Pro) o para volumen alto y bajo costo (Flash).

XIA
público