DeepSeek
Offene MoE- und Reasoning-Modelle von DeepSeek (China) — die V-Reihe als Allzweck-MoE, die R-Reihe für Reasoning und die multimodale Janus-Linie; bekannt für starke Leistung bei niedrigen Kosten.
- DeepSeek Janus-Pro-7B DeepSeek
Janus-Pro-7B ist DeepSeeks Open-Source-Multimodal-Modell vom Januar 2025 — vereint Bildverstehen und Bildgenerierung in einer einzigen 7B-Architektur, MIT-lizenziert.
- DeepSeek R1 DeepSeek
Am 20. Januar 2025 unter MIT-Lizenz veröffentlichtes offenes Reasoning-Modell des chinesischen Labors DeepSeek. Mixture-of-Experts mit 671 Mrd. Parametern (37 Mrd. pro Token aktiv), stark über Reinforcement Learning trainiert; erreichte als erstes offenes Modell OpenAIs o1-Niveau.
- DeepSeek V3 DeepSeek
DeepSeek V3 ist ein im Dezember 2024 veröffentlichtes offenes KI-Modell des chinesischen Anbieters DeepSeek. Es nutzt eine Mixture-of-Experts-Architektur mit 671 Milliarden Parametern (37 Mrd. aktiv je Token) und rund 128.000 Tokens Kontext.
- DeepSeek V3.1 DeepSeek
DeepSeek V3.1 ist das Open-Weights-Hybridmodell von DeepSeek vom August 2025 — vereint Think- und Non-Think-Modus in einem Modell, mit 128K-Kontext und starken Agenten-Fähigkeiten.
- DeepSeek V3.2 DeepSeek
DeepSeek V3.2 (1. Dezember 2025) ist ein offenes MoE-Modell mit 685 Mrd. Parametern unter MIT-Lizenz — dank DeepSeek Sparse Attention besonders effizient bei langen Kontexten.
- DeepSeek V4 DeepSeek
DeepSeek V4 (April 2026) ist die vierte Generation des chinesischen Open-Weight-MoE-Modells — als Pro (1,6 T Parameter) und Flash (284 B) unter MIT-Lizenz veröffentlicht, mit 1-Mio.-Tokens-Kontext.
- DeepSeek V4-Flash DeepSeek
DeepSeek V4-Flash (Juli 2026) ist ein offenes MoE-Modell mit 284 Mrd. Parametern (13 Mrd. aktiv), 1-Mio.-Token-Kontext und MIT-Lizenz — frei ladbar auf Hugging Face.
- DeepSeek V4-Pro DeepSeek
DeepSeek V4-Pro (2026) ist das Open-Weight-Flaggschiff von DeepSeek — ein 1,6-Billionen-Parameter-MoE mit rund 49B aktiven Parametern pro Token, 1-Mio.-Tokens-Kontext und MIT-Lizenz.
- DeepSeek V4.1-Flash DeepSeek
DeepSeek V4.1-Flash (10. September 2026) ist das kleinste Modell der neuen DeepSeek-V4.1-Architektur — erste DeepSeek-Familie mit nativer multimodaler Bildverarbeitung. Speed-/kosten-optimiertes „Flash"-Modell mit offenen Gewichten (MIT), über boostN nutzbar.