DeepSeek V4 Pro 0813
DeepSeek-V4-Pro-0813 é o snapshot de disponibilidade geral datado do modelo principal da DeepSeek: uma mistura de especialistas de 1,6 trilhão de parâmetros com 49 bilhões de parâmetros ativos, janela de contexto de 1M de tokens e até 384K tokens de saída. Ele raciocina por padrão, expõe um endpoint sem raciocínio para chamadas sensíveis à latência, disponibiliza pesos com licença MIT e cobra US$ 0,435 por milhão de tokens de entrada contra US$ 0,87 por milhão de saída.
O que é o DeepSeek V4 Pro 0813?
0813 é uma tag de snapshot, não uma nova arquitetura. Ele fixa a build GA do DeepSeek V4 Pro que apareceu na documentação oficial da API da DeepSeek em 12 de agosto de 2026, ao lado do mais barato DeepSeek-V4-Flash-0731. Aqui está o que o nível principal oferece.
1,6T de Parâmetros, 49B Ativos
Contexto de 1M de Tokens, Saída de 384K Tokens
Raciocínio por Padrão, Três Níveis de Esforço
Feito para Desenvolvedores de Agentes
Pesos Abertos com Licença MIT
Pontuações Próximas da Fronteira a Preços Abertos
DeepSeek V4 Pro 0813 vs DeepSeek V4 Flash 0731
Mesmo contexto de 1M e mesmo teto de saída de 384K em ambos os níveis. O que você compra com o Pro é capacidade — mais parâmetros totais e ativos e raciocínio mais forte — a aproximadamente o triplo do preço por token e um quinto da cota de concorrência.
V4 Flash 0731 | V4 Pro 0813Pro | |
|---|---|---|
| Parâmetros totais | 284B | 1,6T |
| Parâmetros ativos por token | 13B | 49B |
| Janela de contexto | 1M tokens | 1M tokens |
| Saída máxima | 384K tokens | 384K tokens |
| Modo de raciocínio | Raciocínio ativado por padrão, modo sem raciocínio disponível | Raciocínio ativado por padrão, além de Think High e Think Max |
| Entrada por 1M tokens, cache miss | US$ 0,14 | US$ 0,435 |
| Saída por 1M tokens | US$ 0,28 | US$ 0,87 |
| Limite de concorrência da API | 2500 | 500 |
| Melhor para | Classificação em alto volume, extração, chat, passagens longas de contexto baratas | Raciocínio difícil, codificação agêntica, pesquisa profunda, trabalho em repositório inteiro |
DeepSeek V4 Pro 0813 Benchmarks
Pontuações publicadas para DeepSeek-V4-Pro no esforço máximo de raciocínio, a configuração que a DeepSeek reporta como V4-Pro-Max. Trate os números reportados pelo fornecedor como um teto e reexecute suas próprias avaliações antes de comprometer um pipeline.
SWE-bench Verified: 80.6
LiveCodeBench: 93.5
Codeforces: 3206
GPQA Diamond: 90.1
HMMT February 2026: 95.2
Terminal-Bench 2.0: 67.9 e BrowseComp: 83.4
Preços do DeepSeek V4 Pro 0813
Taxas por milhão de tokens na própria API da DeepSeek. O cache de contexto é a rubrica que vale a pena otimizar: um hit de cache custa cerca de um centésimo vigésimo de um miss, então um prompt de sistema estável ou um snapshot de repositório fixo se paga em poucas chamadas. A DeepSeek avisou que os preços gerais da API aumentarão significativamente em um futuro próximo — verifique a página de preços antes de modelar um orçamento.
V4 Flash 0731 | V4 Pro 0813Pro | Grok 4.5 | |
|---|---|---|---|
| Entrada, acerto de cache | $0.0028 | $0.003625 | Não publicado |
| Entrada, erro de cache | $0.14 | $0.435 | Cerca de US$ 2 |
| Saída | US$ 0.28 | US$ 0.87 | Cerca de US$ 6 |
| Janela de contexto | 1M tokens | 1M tokens | 500K tokens |
| Pesos | Aberto, MIT | Aberto, MIT | Fechado |
| Custo para preencher o contexto completo uma vez | Cerca de US$ 0.14 | Cerca de US$ 0.44 | Cerca de US$ 1 para 500K |
Como Usar o DeepSeek V4 Pro 0813
- 01
Passo 1: Fixe a String do Modelo
Chame deepseek-v4-pro na plataforma da DeepSeek para o flagship contínuo, e referencie o snapshot DeepSeek-V4-Pro-0813 quando precisar de uma versão que não mude durante uma avaliação em execução. O endpoint fala o formato OpenAI, então a maioria dos SDKs precisa apenas de uma URL base e uma chave.
- 02
Passo 2: Escolha o Esforço de Raciocínio e Faça Cache do Seu Prefixo
Deixe o pensamento ativado para planejamento, depuração e uso de ferramentas em várias etapas; mude para o endpoint sem pensamento para chamadas limitadas por latência, como autocompletar ou roteamento. Mantenha seu prompt de sistema e quaisquer documentos fixos grandes no início de cada requisição para que eles sejam acertos de cache.
- 03
Passo 3: Ou Contorne a DeepSeek Completamente
Agregadores como OpenRouter listam deepseek/deepseek-v4-pro-0813, e provedores de inferência o servem hospedado. Como os pesos são licenciados sob MIT, você também pode executá-lo em seu próprio hardware — planeje um MoE de 1.6T parâmetros, o que na prática significa um nó multi-GPU mesmo em FP4.
- 04
Passo 4: Aponte a Saída para Algo
Um modelo de texto de fronteira é infraestrutura a montante — ele escreve o plano, o código ou o prompt. Se a entrega for um vídeo ou uma imagem, passe o texto que ele produz para um modelo de geração: cole um prompt escrito pelo DeepSeek diretamente no Editly e renderize.
Perguntas frequentes sobre o DeepSeek V4 Pro 0813
Transforme um Prompt do DeepSeek em Vídeo
Deixe um modelo de texto de ponta escrever a lista de planos e depois renderize. Cadastre-se no Editly e use Seedance, Veo 3, Hailuo e Qwen Image com um único saldo de créditos — sem assinatura por modelo.
