Begriff
DeepSeek R1
Am 20. Januar 2025 unter MIT-Lizenz veröffentlichtes offenes Reasoning-Modell des chinesischen Labors DeepSeek. Mixture-of-Experts mit 671 Mrd. Parametern (37 Mrd. pro Token aktiv), stark über Reinforcement Learning trainiert; erreichte als erstes offenes Modell OpenAIs o1-Niveau.
DeepSeek R1 — ausführlicher erklärt
DeepSeek R1 ist ein Reasoning-Modell des chinesischen KI-Labors DeepSeek, das am 20. Januar 2025 unter der permissiven MIT-Lizenz veröffentlicht wurde. Es sorgte für großes Aufsehen, weil es als erstes offen verfügbares Modell die Reasoning-Leistung von OpenAIs o1 erreichte — bei deutlich geringeren berichteten Trainingskosten. Die offenen Gewichte lassen sich frei herunterladen, weiterverwenden und feinabstimmen.
Technisch ist R1 ein Mixture-of-Experts-Modell (MoE) mit 671 Milliarden Parametern, von denen pro Token nur rund 37 Milliarden aktiv sind. Es baut auf der DeepSeek-V3-Architektur auf. Charakteristisch ist der Trainingsansatz: DeepSeek nutzte großflächig Reinforcement Learning (unter anderem den GRPO-Algorithmus), damit das Modell eigenständig Reasoning-Strategien wie Selbstprüfung und Fehlerkorrektur entwickelt. Das Modell „denkt” über eine sichtbare Gedankenkette (Chain-of-Thought), bevor es antwortet.
Neben dem großen R1 veröffentlichte DeepSeek destillierte, kleinere Varianten (etwa 1,5B, 7B, 8B, 14B, 32B und 70B), die die Reasoning-Fähigkeiten in handlichere, lokal lauffähige Modelle übertragen.
Beispiel / Praxisbezug
DeepSeek R1 eignet sich für Aufgaben mit hohem Logik- und Mathematikanteil: mehrstufige Problemlösung, Code-Reasoning oder wissenschaftliche Fragestellungen. Weil die Gewichte offen und MIT-lizenziert sind, können Unternehmen das Modell selbst hosten — relevant für Datenschutz, Kostenkontrolle und Unabhängigkeit von einem einzelnen API-Anbieter.
Die destillierten Varianten sind besonders praktisch, wenn nicht die volle 671B-Infrastruktur zur Verfügung steht: Ein 32B- oder 70B-Modell läuft auf deutlich kleinerer Hardware und behält einen Teil der Reasoning-Stärke.
Abgrenzung zu ähnlichen Begriffen
R1 ist die Reasoning-Linie von DeepSeek und unterscheidet sich vom Basismodell DeepSeek-V3, das eher auf allgemeine Sprachaufgaben ausgelegt ist. Gegenüber proprietären Reasoning-Modellen (OpenAI o1, Claude mit Extended Thinking) ist R1 offen lizenziert und selbst hostbar. „Destillierte” R1-Modelle sind kleinere Modelle, die auf Ausgaben des großen R1 trainiert wurden — nicht das Original.