Claude Opus 5: Anthropics neues Spitzenmodell setzt auf Effizienz statt Preissturz
Anthropic hat am 24. Juli 2026 Claude Opus 5 veröffentlicht — knapp acht Wochen nach Opus 4.8 (28. Mai 2026) und damit erneut ein Release im engen Takt. Anthropic positioniert Opus 5 als neues Spitzenmodell für komplexe Reasoning-, Coding- und Agenten-Aufgaben und beschreibt es als Modell, das der Frontier-Leistung von Claude Fable 5 nahekomme — bei laut Anbieter etwa halben Kosten pro Aufgabe. Der Token-Preis selbst bleibt dabei unverändert. Für alle, die produktiv mit langen Agenten-Läufen arbeiten, ist genau diese Verschiebung die eigentliche Nachricht.
Was Anthropic zu Opus 5 angibt
- Release am 24. Juli 2026, verfügbar über Claude API, Claude Pro und Max ab dem gleichen Tag.
- Token-Preis unverändert: 5 US-Dollar pro Mio. Input-Token, 25 US-Dollar pro Mio. Output-Token — identisch zu Opus 4.8.
- Kontextfenster: 1 Mio. Token (Default und Maximum), bis zu 128k Output-Token, Thinking standardmäßig aktiv.
- Herstellerangabe: Leistung nahe an Claude Fable 5, aber laut Anthropic zu etwa der Hälfte der Kosten pro Aufgabe.
- Positionierung: neues Standardmodell für Max-Abonnenten, stärkste wählbare Option in Pro.
Was vorher galt
Bis zum 24. Juli war Claude Opus 4.8 das Spitzenmodell von Anthropic. Es war Ende Mai erschienen — nur 42 Tage nach Opus 4.7 — und hatte den Token-Preis bei 5 US-Dollar Input und 25 US-Dollar Output pro Million Token festgeschrieben. Die Verbesserungen dort lagen vor allem im günstigeren Fast Mode und einem Alignment nahe der Mythos-Klasse. Wer die schwersten Aufgaben zuverlässig erledigen wollte, griff zu Fable 5 — dem teuersten und leistungsstärksten Modell im Portfolio.
Die Preisstruktur folgte damit einem klaren Muster: mehr Leistung kostete mehr Token oder ein teureres Modell. Die relevante Vergleichsgröße war der reine Token-Preis pro Million Ein- und Ausgaben.
Was jetzt gilt
1. Gleicher Token-Preis, andere Verkaufslogik. Opus 5 kostet pro Token exakt so viel wie Opus 4.8 — 5 US-Dollar Input, 25 US-Dollar Output pro Million Token. Anthropic verkauft das Modell aber nicht über den Token-Preis, sondern über die Kosten pro erledigter Aufgabe: Wenn Opus 5 für dasselbe Ergebnis weniger Token verbraucht, sinkt der Preis pro Aufgabe, obwohl der Token-Tarif gleich bleibt. Diese Effizienz-Angabe stammt von Anthropic und ist bislang nicht unabhängig überprüft.
2. Fable-nahe Leistung als Anspruch. Anthropic beschreibt Opus 5 als nahe an der Frontier-Intelligenz von Claude Fable 5 — bei laut Anbieter etwa der Hälfte der Kosten pro Aufgabe. Das ist ein Hersteller-Claim, kein neutraler Benchmark. Sollte er sich in der Praxis bestätigen, würde Opus 5 einen großen Teil der Aufgaben abdecken, für die bisher das teurere Fable 5 nötig war.
3. 1 Mio. Token Kontext als Default. Das Kontextfenster von einer Million Token ist bei Opus 5 sowohl Standard als auch Maximum, die Ausgabe reicht bis 128k Token, und der Thinking-Modus ist standardmäßig aktiv. Für lange Agenten-Läufe und große Codebasen ist das die praktisch relevante Größe.
Einordnung
Der auffällige Punkt an diesem Release ist nicht die Leistung, sondern die Metrik, mit der Anthropic sie verkauft. Bislang war der Token-Preis die Vergleichsgröße zwischen Modellen. Opus 5 verschiebt den Fokus auf die Kosten pro Aufgabe — eine Kennzahl, die stark davon abhängt, wie viele Token ein Modell für ein Ergebnis tatsächlich braucht. Das ist für Agenten-Workloads sinnvoll, weil dort die meisten Kosten über viele Schritte hinweg entstehen. Es ist aber auch eine Kennzahl, die sich schwerer unabhängig prüfen lässt als ein reiner Token-Tarif: Der Token-Verbrauch pro Aufgabe schwankt mit Prompt, Tooling und Aufgabentyp.
Bemerkenswert ist außerdem der Release-Takt. Opus 4.7, 4.8 und jetzt Opus 5 kamen innerhalb weniger Monate. Für Agenturen und Teams heißt das: Das jeweils aktuelle Spitzenmodell ist kein stabiler Bezugspunkt mehr, sondern ein bewegliches Ziel. Wer Workflows fest auf ein bestimmtes Modell verdrahtet, muss häufiger nachjustieren als noch vor einem Jahr.
Für die konkrete Kostenrechnung heißt das: Die interessante Frage ist nicht mehr „Was kostet die Million Token?”, sondern „Wie viele Token braucht das Modell für meine typische Aufgabe?”. Diese Zahl lässt sich nur im eigenen Setup messen — nicht aus dem Preisblatt ableiten.
Was du jetzt tun kannst
Wenn du Opus 4.8 oder Fable 5 im Einsatz hast: Miss den Token-Verbrauch pro typischer Aufgabe vor und nach dem Wechsel auf Opus 5, statt dich auf die Effizienz-Angabe zu verlassen. Erst dann weißt du, ob die „halben Kosten pro Aufgabe” in deinem Setup ankommen.
Wenn du bisher Fable 5 für schwere Aufgaben gebraucht hast: Teste, ob Opus 5 dieselben Aufgaben in vergleichbarer Qualität löst. Bestätigt sich der Anspruch, kannst du einen Teil der Fable-Last zu geringeren Kosten auf Opus 5 verlagern.
Wenn du Modell-Workflows fest verdrahtet hast: Rechne mit weiteren Punkt-Releases in kurzen Abständen. Halte die Modell-Auswahl an einer zentralen Stelle konfigurierbar, damit ein Wechsel keine Umbauten quer durch den Code bedeutet.