Grok 4.6: xAIs Flaggschiff für lange Agenten-Läufe
xAI hat am 12. August 2026 Grok 4.6 veröffentlicht — das neue Flaggschiff der Grok-Linie. Es baut auf Grok 4.5 auf und ist kein kompletter Generationswechsel, sondern eine gezielte Verstärkung: langlaufende Agenten, anspruchsvollere interaktive und visuelle Aufgaben. Zwei Dinge stechen praktisch heraus — ein Kontextfenster von 500.000 Token und ein gestaffelter Preis, der lange Kontexte kalkulierbar hält.
Was neu ist
- Release: 12. August 2026, neues Flaggschiff nach Grok 4.5.
- Ein-/Ausgabe: Text- und Bild-Input, reine Text-Ausgabe. Kontextfenster: 500.000 Token, kein festes Limit für die Ausgabelänge.
- Leistung: Artificial Analysis Intelligence Index 61 — gleichauf mit GPT-5.6 Sol, einen Punkt hinter Claude Fable 5.
- Preis (gestaffelt, je 1 Mio. Token): unter 200k Prompt-Token 2 USD Input / 0,50 USD gecachter Input / 6 USD Output; darüber 4 / 1 / 12 USD.
Was passiert ist
Grok 4.6 schärft das Profil seines Vorgängers, statt es neu zu erfinden. Der Schwerpunkt liegt auf agentischer Arbeit über lange Zeiträume — Aufgaben, die das Modell in vielen Schritten selbstständig abarbeitet, mit Zwischenbewertungen und Kurskorrekturen. Dazu kommen bessere visuelle Fähigkeiten: Grok 4.6 nimmt Text und Bild entgegen und gibt Text aus.
Im herstellerunabhängigen Artificial Analysis Intelligence Index landet das Modell bei 61 Punkten — gleichauf mit GPT-5.6 Sol und einen Punkt hinter Claude Fable 5. Das ist Frontier-Nähe, nicht Frontier-Spitze; der eigentliche Hebel liegt woanders.
Warum das wichtig ist
Für Agenten-Pipelines zählt selten die reine Benchmark-Zahl, sondern die Kombination aus Kontextgröße und Kosten. Genau hier positioniert sich Grok 4.6: 500.000 Token Kontext sind genug, um lange Verläufe, große Dokumente oder ganze Werkzeug-Historien am Stück zu halten — und der gestaffelte Preis hält das bezahlbar, solange der Prompt unter 200k Token bleibt. Erst darüber verdoppelt sich der Tarif. Wer seine Prompts bewusst unter dieser Schwelle hält, fährt spürbar günstiger.
Der zweite Punkt ist die Verfügbarkeit. Grok 4.6 läuft nicht nur über die xAI-API (Responses und Chat Completions), sondern auch in Cursor, Grok Build, OpenRouter, Vercel und Cloudflare — und über die großen Cloud-Marktplätze Microsoft Foundry, Google Enterprise Agent Platform und Amazon Bedrock. Für ein Modell aus dem xAI-Umfeld, dessen Verbreitung außerhalb der X-Plattform lange überschaubar war, ist diese Breite an Zugängen der eigentliche Fortschritt.
Einzuordnen bleibt: Die 500k-Kontextgröße ist eine Obergrenze, keine Qualitätsgarantie über die volle Länge — wie bei praktisch allen Modellen sinkt die Verlässlichkeit gegen Ende langer Kontexte. Das gehört am eigenen Use-Case getestet, nicht aus dem Datenblatt geschlossen.
Was du jetzt tun kannst
Wenn du Agenten mit langen Kontexten baust: Prüfe Grok 4.6 an einer echten, mehrstündigen Aufgabe und miss die Kosten mit realistischen Prompt-Größen — die 200k-Schwelle entscheidet spürbar über den Tarif.
Wenn du Modelle über Cloud-Marktplätze beziehst: Grok 4.6 ist jetzt breit verfügbar und damit erstmals ohne X-Bindung sinnvoll einsetzbar. Details zu Benchmarks, Preisstaffel und Zugängen im Glossar-Eintrag → Grok 4.6, die Einordnung der Linie im Hub → Grok.