Models

DeepSeek V4 Pro 0813: Massives MoE-Modell mit 1,6 Billionen Parametern erreicht General Availability

deepseek llm openrouter

Mit dem V4 Pro 0813 hat DeepSeek die General-Availability-Version seines grossskaligen Mixture-of-Experts-Modells veroeffentlicht. Das Modell verfuegt ueber 1,6 Billionen Gesamtparameter, von denen pro Forward-Pass 49 Milliarden aktiviert werden. Unterstuetzt wird ein Kontextfenster von einer Million Token.

Eine zentrale Neuerung ist das hybride Aufmerksamkeitssystem, das eine effiziente Verarbeitung langer Kontexte ermoeglicht. Zustaetzlich unterstuetzt das Modell die Reasoning-Stufen “high” und “xhigh”, wobei xhigh auf maximales Reasoning abgebildet wird. Einsatzgebiete umfassen Codeanalyse ganzer Repositories, mehrstufige Automatisierungen und grossflaechige Informationssynthese.

Ueber OpenRouter wird das Modell ausschliesslich von DeepSeek selbst gehostet. Die Preisgestaltung liegt bei 0,435 USD pro Million Eingabe-Token und 0,87 USD pro Million Ausgabe-Token, mit verguenstigten Cache-Reads bei 0,003625 USD. Die Provider-Verfuegbarkeit betraegt 100 Prozent bei einer P50-Latenz von 1,70 Sekunden und einem Durchsatz von 52 Token pro Sekunde.

In Benchmarks erzielt V4 Pro 0813 einen Artificial-Analysis-Intelligence-Index von 45,3 sowie einen Coding-Index von 59,4. Auf GPQA Diamond erreicht es 88,8 Prozent, bei Humanity’s Last Exam 37,5 Prozent und im Terminal-Bench-Hard-Test 46,2 Prozent. Die Cache-Trefferrate liegt bei 92,3 Prozent.

Originalquelle: OpenRouter - DeepSeek V4 Pro