Zurück zum Glossar

Begriff

DeepSeek V3.1

DeepSeek V3.1 ist das Open-Weights-Hybridmodell von DeepSeek vom August 2025 — vereint Think- und Non-Think-Modus in einem Modell, mit 128K-Kontext und starken Agenten-Fähigkeiten.

DeepSeek V3.1 — ausführlicher erklärt

DeepSeek V3.1 erschien am 21. August 2025 und ist das erste Hybrid-Modell von DeepSeek: Es vereint einen schnellen Non-Think-Modus und einen tiefer schließenden Think-Modus in einem einzigen Modell, statt wie zuvor separate Chat- und Reasoning-Modelle (V3 und R1) auszuliefern. Der Modus wird per Prompt-Template gewählt. DeepSeek positioniert V3.1 als offen gewichtetes Modell, dessen Gewichte auf Hugging Face liegen; der Code ist MIT-lizenziert, die Modell-Lizenz erlaubt kommerzielle Nutzung.

Eckdaten

  • Release: 21. August 2025, Zugang über offene Gewichte (Hugging Face) sowie die DeepSeek-API.
  • Architektur: Mixture-of-Experts mit 671 Mrd. Parametern, davon rund 37 Mrd. je Token aktiv.
  • Kontextfenster: bis zu 128.000 Tokens (zweiphasiges Long-Context-Training auf Basis von V3).
  • Hybrid-Inferenz: Think- und Non-Think-Modus in einem Modell; laut DeepSeek erreicht der Think-Modus die Antwortqualität von R1-0528 bei schnellerer Reaktion.
  • Effizienz: vergleichbare Benchmark-Werte bei etwa 25 bis 50 Prozent weniger Tokens.

Beispiel / Praxisbezug

V3.1 eignet sich für Betreiber, die ein leistungsstarkes Modell selbst hosten oder ohne proprietäre Bindung über die API nutzen wollen. Die offenen Gewichte erlauben Feintuning und On-Premise-Betrieb — relevant für Datenschutz und Kostenkontrolle. Die verbesserten Agenten-Fähigkeiten und mitgelieferten Beispiel-Pattern (Coding-, Python-Tool- und Such-Agenten) machen es für agentische Workflows attraktiv.

Abgrenzung

V3.1 löst die getrennte Aufstellung aus DeepSeek V3 (Chat) und R1 (Reasoning) durch ein einziges Hybrid-Modell ab. Im Gegensatz zu proprietären Modellen wie GPT, Claude oder Gemini stehen die Gewichte offen zur Verfügung, was Selbst-Hosting und Anpassung ermöglicht — bei allerdings höherem Infrastruktur-Aufwand. Direkte Vergleichsmodelle sind andere offene Gewichte sowie die Mid-Tier-Stufen der proprietären Anbieter.

Alle Beiträge im Überblick:DeepSeek V