DeepSeek V4 Pro 0813
DeepSeek-V4-Pro-0813 ist der datierte General-Availability-Snapshot des Flaggschiff-Modells von DeepSeek: ein Mixture-of-Experts mit 1,6 Billionen Parametern, 49 Milliarden aktiven Parametern, einem 1M-Token-Kontextfenster und bis zu 384K Token Ausgabe. Es denkt standardmäßig, stellt einen Non-Thinking-Endpoint für latenzkritische Aufrufe bereit, liefert MIT-lizenzierte Gewichte und kostet 0,435 $ pro Million Input-Tokens gegenüber 0,87 $ pro Million Output.
Was ist DeepSeek V4 Pro 0813?
0813 ist ein Snapshot-Tag, keine neue Architektur. Es fixiert den GA-Build von DeepSeek V4 Pro, der am 12. August 2026 in den offiziellen API-Dokumenten von DeepSeek erschien, neben dem günstigeren DeepSeek-V4-Flash-0731. Hier ist, was die Flaggschiff-Stufe mitbringt.
1,6T Parameter, 49B aktiv
1M-Token-Kontext, 384K-Token-Ausgabe
Denken standardmäßig, drei Anstrengungsstufen
Gebaut für Agent-Entwickler
MIT-lizenzierte offene Gewichte
Frontier-nahe Scores zu offenen Preisen
DeepSeek V4 Pro 0813 vs. DeepSeek V4 Flash 0731
Gleicher 1M-Kontext und gleiche 384K-Ausgabegrenze auf beiden Stufen. Was Sie mit Pro kaufen, ist Kapazität — mehr Gesamt- und aktive Parameter und stärkeres Reasoning — zu etwa dem dreifachen Token-Preis und einem Fünftel der Concurrency-Erlaubnis.
V4 Flash 0731 | V4 Pro 0813Pro | |
|---|---|---|
| Gesamtparameter | 284B | 1,6T |
| Aktive Parameter pro Token | 13B | 49B |
| Kontextfenster | 1M Tokens | 1M Tokens |
| Maximale Ausgabe | 384K Tokens | 384K Tokens |
| Denkmodus | Denken standardmäßig aktiv, Nicht-Denken verfügbar | Denken standardmäßig aktiv, plus Think High und Think Max |
| Eingabe pro 1M Tokens, Cache-Miss | 0,14 $ | 0,435 $ |
| Ausgabe pro 1M Tokens | 0,28 $ | 0,87 $ |
| API-Concurrency-Limit | 2500 | 500 |
| Am besten geeignet für | Klassifizierung mit hohem Volumen, Extraktion, Chat, günstige Long-Context-Pässe | Schwieriges Reasoning, agentisches Coding, Deep Research, Arbeit mit dem gesamten Repository |
DeepSeek V4 Pro 0813 Benchmarks
Veröffentlichte Ergebnisse für DeepSeek-V4-Pro bei maximaler Reasoning-Anstrengung, der Konfiguration, die DeepSeek als V4-Pro-Max angibt. Behandeln Sie herstellerberichtete Zahlen als Obergrenze und führen Sie vor der Pipeline-Integration eigene Evaluierungen durch.
SWE-bench Verified: 80.6
LiveCodeBench: 93.5
Codeforces: 3206
GPQA Diamond: 90.1
HMMT Februar 2026: 95.2
Terminal-Bench 2.0: 67.9 und BrowseComp: 83.4
DeepSeek V4 Pro 0813 Preise
Preise pro Million Tokens auf DeepSeek-eigener API. Kontext-Caching ist der Posten, um den herum man die Architektur planen sollte: Ein Cache-Treffer kostet etwa ein Hundertzwanzigstel eines Fehltreffers, sodass sich ein stabiler System-Prompt oder ein eingefrorener Repository-Snapshot bereits nach wenigen Aufrufen amortisiert. DeepSeek hat gewarnt, dass die API-Preise insgesamt in naher Zukunft deutlich steigen werden – prüfen Sie die Preisseite, bevor Sie ein Budget modellieren.
V4 Flash 0731 | V4 Pro 0813Pro | Grok 4.5 | |
|---|---|---|---|
| Eingabe, Cache-Treffer | $0.0028 | $0.003625 | Nicht veröffentlicht |
| Eingabe, Cache-Fehltreffer | $0.14 | $0.435 | Etwa $2 |
| Ausgabe | $0.28 | $0.87 | Etwa $6 |
| Kontextfenster | 1M Tokens | 1M Tokens | 500K Tokens |
| Gewichte | Offen, MIT | Offen, MIT | Geschlossen |
| Kosten, um den vollständigen Kontext einmal zu füllen | Etwa $0.14 | Etwa $0.44 | Etwa $1 für 500K |
So verwenden Sie DeepSeek V4 Pro 0813
- 01
Schritt 1: Modell-String anheften
Rufen Sie deepseek-v4-pro auf der Plattform von DeepSeek für das rollierende Flaggschiff auf und referenzieren Sie den DeepSeek-V4-Pro-0813-Snapshot, wenn Sie einen Build benötigen, der sich unter einer laufenden Auswertung nicht verschiebt. Der Endpunkt spricht das OpenAI-Format, sodass die meisten SDKs nur eine Basis-URL und einen Schlüssel benötigen.
- 02
Schritt 2: Reasoning-Aufwand wählen und Präfix cachen
Lassen Sie das Denken für Planung, Debugging und mehrstufige Tool-Nutzung aktiv; wechseln Sie für latenzgebundene Aufrufe wie Autovervollständigung oder Routing zum Nicht-Denken-Endpunkt. Halten Sie Ihren System-Prompt und alle großen festen Dokumente am Anfang jeder Anfrage, damit sie als Cache-Treffer landen.
- 03
Schritt 3: Oder DeepSeek komplett umgehen
Aggregatoren wie OpenRouter listen deepseek/deepseek-v4-pro-0813, und Inferenzanbieter stellen es gehostet bereit. Da die Gewichte MIT-lizenziert sind, können Sie es auch auf Ihrer eigenen Hardware ausführen – planen Sie ein MoE mit 1.6T Parametern ein, was in der Praxis einen Multi-GPU-Knoten selbst in FP4 bedeutet.
- 04
Schritt 4: Die Ausgabe auf etwas richten
Ein Frontier-Textmodell ist die vorgelagerte Infrastruktur – es schreibt den Plan, den Code oder den Prompt. Wenn das Ergebnis ein Video oder ein Bild ist, übergib den erzeugten Text an ein Generierungsmodell: Füge einen von DeepSeek geschriebenen Prompt direkt in Editly ein und rendere ihn.
Häufig gestellte Fragen zu DeepSeek V4 Pro 0813
Verwandeln Sie einen DeepSeek-Prompt in ein Video
Lassen Sie ein führendes Textmodell die Einstellungsliste schreiben und rendern Sie sie dann. Melden Sie sich bei Editly an und nutzen Sie Seedance, Veo 3, Hailuo und Qwen Image mit einem einzigen Guthaben – ohne Abo pro Modell.
