DeepSeek V4 Pro 0813
DeepSeek-V4-Pro-0813 is de gedateerde general-availability-snapshot van DeepSeek's vlaggenschipmodel: een mixture-of-experts met 1.6 biljoen parameters en 49 miljard actieve parameters, een contextvenster van 1M tokens en tot 384K tokens output. Het denkt standaard, biedt een non-thinking endpoint voor latentiegevoelige calls, levert MIT-gelicenseerde weights en rekent $0.435 per miljoen input tokens en $0.87 per miljoen output.
Wat is DeepSeek V4 Pro 0813?
0813 is een snapshot-tag, geen nieuwe architectuur. Het verwijst naar de GA-build van DeepSeek V4 Pro die op 12 augustus 2026 in de officiële API-documentatie van DeepSeek verscheen, naast de goedkopere DeepSeek-V4-Flash-0731. Dit is wat de vlaggenschip-tier biedt.
1.6T parameters, 49B actief
1M-token context, 384K-token output
Standaard denken, drie inspanningsniveaus
Gebouwd voor agent-ontwikkelaars
MIT-gelicenseerde open weights
Frontier-adjacente scores tegen open prijzen
DeepSeek V4 Pro 0813 vs DeepSeek V4 Flash 0731
Zelfde 1M-context en zelfde 384K-outputplafond op beide tiers. Wat je met Pro koopt is capaciteit — meer totale en actieve parameters en sterker redeneren — tegen ongeveer drie keer de tokenprijs en een vijfde van de concurrency-toelage.
V4 Flash 0731 | V4 Pro 0813Pro | |
|---|---|---|
| Totale parameters | 284B | 1.6T |
| Actieve parameters per token | 13B | 49B |
| Contextvenster | 1M tokens | 1M tokens |
| Maximale output | 384K tokens | 384K tokens |
| Denkmodus | Denken standaard aan, non-thinking beschikbaar | Denken standaard aan, plus Think High en Think Max |
| Invoer per 1M tokens, cache miss | $0.14 | $0.435 |
| Uitvoer per 1M tokens | $0.28 | $0.87 |
| API-concurrentielimiet | 2500 | 500 |
| Het beste voor | Classificatie op hoge volumes, extractie, chat, goedkope lange-contextpassages | Moeilijke redenering, agentische codering, diepgaand onderzoek, werk aan de hele repository |
DeepSeek V4 Pro 0813 Benchmarks
Gepubliceerde scores voor DeepSeek-V4-Pro bij maximale redeneerinspanning, de configuratie die DeepSeek rapporteert als V4-Pro-Max. Beschouw door de leverancier gerapporteerde cijfers als een plafond en voer je eigen evals opnieuw uit voordat je een pipeline vastlegt.
SWE-bench Verified: 80.6
LiveCodeBench: 93.5
Codeforces: 3206
GPQA Diamond: 90.1
HMMT February 2026: 95.2
Terminal-Bench 2.0: 67.9 and BrowseComp: 83.4
DeepSeek V4 Pro 0813 Prijzen
Tarieven per miljoen tokens op DeepSeek's eigen API. Contextcaching is de post waar je omheen moet ontwerpen: een cache-hit kost ongeveer een honderdtwintigste van een misser, dus een stabiele system prompt of een vastgezette repository-snapshot betaalt zichzelf binnen een paar calls terug. DeepSeek heeft gewaarschuwd dat de algehele API-prijzen in de nabije toekomst aanzienlijk zullen stijgen — bekijk de prijspagina voordat je een budget modelleert.
V4 Flash 0731 | V4 Pro 0813Pro | Grok 4.5 | |
|---|---|---|---|
| Input, cache hit | $0.0028 | $0.003625 | Niet gepubliceerd |
| Input, cache miss | $0.14 | $0.435 | Ongeveer $2 |
| Output | $0.28 | $0.87 | Ongeveer $6 |
| Contextvenster | 1M tokens | 1M tokens | 500K tokens |
| Gewichten | Open, MIT | Open, MIT | Gesloten |
| Kosten om de volledige context één keer te vullen | Ongeveer $0.14 | Ongeveer $0.44 | Ongeveer $1 voor 500K |
Hoe DeepSeek V4 Pro 0813 te gebruiken
- 01
Stap 1: Pin de modelstring
Roep deepseek-v4-pro aan op het platform van DeepSeek voor de rolling flagship, en verwijs naar de DeepSeek-V4-Pro-0813 snapshot wanneer je een build nodig hebt die niet verschuift tijdens een lopende evaluatie. Het endpoint spreekt het OpenAI-formaat, dus de meeste SDK's hebben alleen een base URL en een sleutel nodig.
- 02
Stap 2: Kies reasoning effort en cache je prefix
Laat thinking aan voor planning, debugging en multi-step toolgebruik; schakel over naar het non-thinking endpoint voor latency-gebonden calls zoals autocomplete of routing. Houd je system prompt en eventuele grote vaste documenten aan het begin van elk verzoek, zodat ze als cache hits terechtkomen.
- 03
Stap 3: Of routeer volledig om DeepSeek heen
Aggregators zoals OpenRouter vermelden deepseek/deepseek-v4-pro-0813, en inference providers bieden het gehost aan. Omdat de gewichten MIT-licensed zijn, kun je het ook op je eigen hardware draaien — reken op een 1.6T-parameter MoE, wat in de praktijk een multi-GPU node betekent, zelfs in FP4.
- 04
Stap 4: Richt de output ergens op
Een frontier-tekstmodel is upstream-infrastructuur — het schrijft het plan, de code of de prompt. Als het eindresultaat een video of afbeelding is, geef de tekst die het produceert door aan een generatiemodel: plak een door DeepSeek geschreven prompt rechtstreeks in Editly en render deze.
Veelgestelde vragen over DeepSeek V4 Pro 0813
Zet een DeepSeek-prompt om in video
Laat een toonaangevend tekstmodel de shotlist schrijven en render het vervolgens. Meld je aan voor Editly en draai Seedance, Veo 3, Hailuo en Qwen Image op één tegoed — geen abonnement per model.
