Claude Haiku: Anthropics schnelle, günstige Linie
Aktuell
Das aktuelle Flaggschiff der Linie ist Claude Haiku 4.5 (Release 15. Oktober 2025). Anders als Sonnet, Opus und Fable ist Haiku noch nicht auf Generation 5 — Details zu Preis, Kontextfenster und Benchmarks stehen im Glossar-Eintrag.
Wofür Claude Haiku steht
Haiku ist die untere der drei klassischen Claude-Linien — und die einzige, bei der Tempo und Preis das erste Auswahlkriterium sind, nicht das zweite. Anthropic teilt seine Modelle seit Claude 3 in drei Größen: Opus für die schwersten Aufgaben, Sonnet als ausgewogene Mitte, Haiku für alles, was schnell und in großer Zahl passieren muss. Bemerkenswert ist dabei, wie weit die Latte gerückt ist: Haiku 4.5 erreicht in vielen Aufgaben das Niveau, das ein Jahr zuvor die Sonnet-Klasse markierte — zu einem Bruchteil der Kosten.
Ein Punkt zur Einordnung: Haiku hinkt im Versionszyklus bewusst hinterher. Während Sonnet, Opus und die neue Fable-Stufe bereits auf Generation 5 sind, bleibt Haiku 4.5 vom Oktober 2025 Stand September 2026 das aktuelle Modell der Linie.
- Coding 3.5 / 5 · Claude Opus 5 u. a.
- Reasoning 3 / 5 · Claude Opus 5 u. a.
- Text 4 / 5 · Claude Fable 5.1
- Vision 3.5 / 5 · Gemini 3.1 Pro
- Speed 5 / 5 · Feld-Spitze
- Kosten-Eff. 4.5 / 5 · GPT Luna u. a.
Eignung 0–5 · redaktionelle Einordnung, kein Benchmark · gestrichelt = Feld-Bestwert je Achse
Das Profil ist das Spiegelbild von Opus: Spitzenwerte bei Speed und Kosten-Effizienz, solide bei Text und Coding, bewusst zurückhaltend bei tiefem Reasoning. Genau dafür ist die Linie gebaut.
Einsatzprofil
Haiku spielt seine Stärke bei Aufgaben aus, die hohes Volumen und niedrige Latenz verlangen:
- Klassifikation und Extraktion — Tickets einsortieren, Entitäten aus Dokumenten ziehen, strukturierte Felder befüllen, tausendfach am Tag.
- Chat-Support in Echtzeit — kurze Antwortzeiten sind hier ein Feature, nicht nur nice-to-have.
- Schneller paralleler Sub-Agent — unter einem orchestrierenden Sonnet oder Opus die vielen kleinen Teilschritte gleichzeitig abarbeiten. Genau dieses Muster macht Haiku in Multi-Agenten-Systemen wertvoll.
Stolperfalle: kein Effort-Parameter
Kein Modell der Haiku-Linie unterstützt die Effort-Stufen, die Anthropic bei den größeren Modellen anbietet. Anthropics Modell-Spezifikation führt für Haiku 4.5 explizit „Default effort: Not supported”. Reasoning-Tiefe steuerst du stattdessen über ein manuelles, numerisches Thinking-Budget (budget_tokens). Wer Code von einem größeren Modell übernimmt, muss diese Stelle anpassen — sonst schlägt der Aufruf fehl.
Auswahlhilfe: Haiku, Sonnet oder Opus?
Die drei Linien lösen dasselbe Grundproblem an unterschiedlichen Punkten der Kurve aus Können, Tempo und Preis. Die Positionierungskarte zeigt, wo Haiku im Feld steht:
Redaktionelle Einordnung, kein Benchmark
Als Faustregel:
- Latenz und Preis sind das Nadelöhr, die Aufgabe ist klar umrissen? Dann Haiku.
- Du willst gute Qualität bei moderatem Volumen? Dann Sonnet.
- Ein langer Lauf, bei dem jeder Zwischenschritt sitzen muss? Dann Opus.
Im Vergleich zu Googles Gemini Flash oder GPT Luna besetzt Haiku dieselbe Volumen-Zone: schnell, günstig, moderate Reasoning-Tiefe. Gemini Flash bringt zusätzlich native Video- und Audio-Fähigkeiten mit, Luna liegt im Coding etwas hinter Haiku. Welches Modell passt, entscheidet die konkrete Modalität deiner Aufgabe.
Weiterlesen
- Claude Haiku 4.5 — das aktuelle Flaggschiff mit Preisen und Benchmarks
- KI-Modellfamilien im Überblick — Haiku im Vergleich zu GPT, Gemini und Co.
- KI-Pricing einfach erklärt — warum der Haiku-Preis für Volumen zählt
- KI-Agenten bauen — Haiku als paralleler Sub-Agent
FAQ
- Die Position in der Linien-Architektur: Haiku ist auf niedrige Latenz und niedrige Kosten optimiert, Sonnet ist die ausgewogene Mittelklasse, Opus die Top-Tier-Linie für die schwersten Reasoning- und Coding-Aufgaben.
- Nein. Kein Modell der Haiku-Linie unterstützt Effort-Stufen; Anthropics Modell-Spezifikation führt für Haiku 4.5 explizit "Default effort: Not supported". Reasoning-Tiefe läuft stattdessen über ein manuelles, numerisches Thinking-Budget (budget_tokens).
- Für Aufgaben mit hohem Volumen und niedriger Latenz — Klassifikation, Extraktion, Chat-Support — sowie als schneller paralleler Sub-Agent in Multi-Agenten-Systemen unter einem orchestrierenden Sonnet oder Opus.
- Stand September 2026 nein. Haiku 4.5 vom Oktober 2025 bleibt das aktuelle Flaggschiff der Linie, obwohl Sonnet, Opus und die neue Fable/Mythos-Stufe bereits auf Generation 5 sind.
- Alle drei besetzen dieselbe Volumen-Zone: schnell, günstig, moderate Reasoning-Tiefe. Gemini Flash bringt zusätzlich native Video- und Audio-Fähigkeiten mit, GPT Luna liegt im Coding-Score etwas hinter Haiku.