DeepSeek V4 Pro 0813
DeepSeek-V4-Pro-0813 es la instantánea de disponibilidad general con fecha del modelo insignia de DeepSeek: un mixture-of-experts de 1.6 billones de parámetros con 49 mil millones de parámetros activos, una ventana de contexto de 1M tokens y hasta 384K tokens de salida. Piensa por defecto, expone un endpoint sin pensamiento para llamadas sensibles a la latencia, incluye pesos con licencia MIT y cobra $0.435 por millón de tokens de entrada frente a $0.87 por millón de salida.
¿Qué es DeepSeek V4 Pro 0813?
0813 es una etiqueta de instantánea, no una arquitectura nueva. Fija la compilación GA de DeepSeek V4 Pro que apareció en la documentación oficial de la API de DeepSeek el 12 de agosto de 2026, junto al más económico DeepSeek-V4-Flash-0731. Esto es lo que incluye el nivel insignia.
1.6T Parámetros, 49B Activos
Contexto de 1M Tokens, Salida de 384K Tokens
Pensamiento por Defecto, Tres Niveles de Esfuerzo
Diseñado para Desarrolladores de Agentes
Pesos Abiertos con Licencia MIT
Puntuaciones Cercanas a la Frontera a Precios Abiertos
DeepSeek V4 Pro 0813 vs DeepSeek V4 Flash 0731
El mismo contexto de 1M y el mismo límite de salida de 384K en ambos niveles. Lo que compras con Pro es capacidad: más parámetros totales y activos y un razonamiento más fuerte, a aproximadamente el triple del precio por token y una quinta parte de la asignación de concurrencia.
V4 Flash 0731 | V4 Pro 0813Pro | |
|---|---|---|
| Parámetros totales | 284B | 1.6T |
| Parámetros activos por token | 13B | 49B |
| Ventana de contexto | 1M de tokens | 1M de tokens |
| Salida máxima | 384K de tokens | 384K de tokens |
| Modo de pensamiento | Pensamiento activado por defecto, disponible modo sin pensamiento | Pensamiento activado por defecto, además de Think High y Think Max |
| Entrada por 1M de tokens, fallo de caché | $0,14 | $0,435 |
| Salida por 1M de tokens | $0,28 | $0,87 |
| Límite de concurrencia de API | 2500 | 500 |
| Ideal para | Clasificación de alto volumen, extracción, chat, pasadas de contexto largo económicas | Razonamiento complejo, codificación agéntica, investigación profunda, trabajo en repositorio completo |
Puntos de referencia de DeepSeek V4 Pro 0813
Puntuaciones publicadas para DeepSeek-V4-Pro con el máximo esfuerzo de razonamiento, la configuración que DeepSeek reporta como V4-Pro-Max. Trata las cifras reportadas por el proveedor como un techo y vuelve a ejecutar tus propias evaluaciones antes de comprometer un pipeline.
SWE-bench Verified: 80.6
LiveCodeBench: 93.5
Codeforces: 3206
GPQA Diamond: 90.1
HMMT February 2026: 95.2
Terminal-Bench 2.0: 67.9 y BrowseComp: 83.4
Precios de DeepSeek V4 Pro 0813
Tarifas por millón de tokens en la propia API de DeepSeek. El almacenamiento en caché de contexto es la partida que vale la pena diseñar: un acierto de caché cuesta aproximadamente una centésima vigésima parte de un fallo, por lo que un prompt de sistema estable o una instantánea de repositorio fijada se amortiza en unas pocas llamadas. DeepSeek ha advertido que los precios generales de la API aumentarán significativamente en un futuro cercano: consulta su página de precios antes de modelar un presupuesto.
V4 Flash 0731 | V4 Pro 0813Pro | Grok 4.5 | |
|---|---|---|---|
| Entrada, acierto de caché | $0.0028 | $0.003625 | No publicado |
| Entrada, fallo de caché | $0.14 | $0.435 | Alrededor de $2 |
| Salida | $0.28 | $0.87 | Alrededor de $6 |
| Ventana de contexto | 1M tokens | 1M tokens | 500K tokens |
| Pesos | Abierto, MIT | Abierto, MIT | Cerrado |
| Costo de llenar el contexto completo una vez | Alrededor de $0.14 | Alrededor de $0.44 | Alrededor de $1 por 500K |
Cómo usar DeepSeek V4 Pro 0813
- 01
Paso 1: Fija la cadena del modelo
Llama a deepseek-v4-pro en la plataforma de DeepSeek para el modelo insignia en evolución, y referencia la instantánea DeepSeek-V4-Pro-0813 cuando necesites una versión que no cambie durante una evaluación en curso. El endpoint usa el formato de OpenAI, por lo que la mayoría de los SDK solo necesitan una URL base y una clave.
- 02
Paso 2: Elige el esfuerzo de razonamiento y guarda en caché tu prefijo
Deja el pensamiento activado para planificación, depuración y uso de herramientas de múltiples pasos; cambia al endpoint sin pensamiento para llamadas limitadas por latencia como autocompletado o enrutamiento. Mantén tu prompt de sistema y cualquier documento fijo grande al inicio de cada solicitud para que se registren como aciertos de caché.
- 03
Paso 3: O evita DeepSeek por completo
Agregadores como OpenRouter listan deepseek/deepseek-v4-pro-0813, y los proveedores de inferencia lo ofrecen alojado. Dado que los pesos tienen licencia MIT, también puedes ejecutarlo en tu propio hardware: presupuesta un MoE de 1.6T parámetros, lo que en la práctica significa un nodo multi-GPU incluso en FP4.
- 04
Paso 4: Apunta la salida a algo
Un modelo de texto de frontera es infraestructura upstream: escribe el plan, el código o el prompt. Si el entregable es un vídeo o una imagen, pasa el texto que produce a un modelo de generación: pega un prompt escrito por DeepSeek directamente en Editly y renderízalo.
Preguntas frecuentes sobre DeepSeek V4 Pro 0813
Convierte un prompt de DeepSeek en video
Deja que un modelo de texto de frontera escriba la lista de tomas y luego renderízalo. Regístrate en Editly y ejecuta Seedance, Veo 3, Hailuo y Qwen Image con un solo saldo de créditos, sin suscripción por modelo.
