GPT-6 Astra: OpenAIs erstes Modell auf der Cyber-Stufe Critical
OpenAI hat am 3. September 2026 GPT-6 Astra in einem begrenzten Rollout gestartet und einen Tag später breiter geöffnet. Die Nachricht daran ist weniger das Modell selbst als die Einstufung: Astra ist laut OpenAI das erste Modell, das im hauseigenen Preparedness Framework die Cybersecurity-Stufe Critical erreicht — es kann unter passenden Bedingungen unbekannte Sicherheitslücken selbst finden und ausnutzen, ohne dass ein Mensch jeden Schritt führt.
Wichtig vorweg: Belastbar getestet hat das Modell außerhalb von OpenAI und einem kleinen Kreis von Testern bisher niemand. Alles, was aktuell über Astra bekannt ist, stammt vom Anbieter oder aus Berichterstattung darüber.
Was OpenAI und die Berichterstattung angeben
- Rollout: 3. September 2026 zunächst für Teilnehmer des Cybersecurity-Programms Daybreak; ab 4. September schrittweise für ChatGPT Plus, Pro, Business und Enterprise sowie über API und AWS.
- Zwei Varianten: Die breit verfügbare Version verweigert fortgeschrittene Cybersecurity-Aufgaben; die volle Cyber-Fähigkeit bleibt hinter dem Daybreak-Antragsverfahren.
- Schwerpunkt Computer Use: Astra bedient Rechner wie ein Mensch — Formulare ausfüllen, Tabellen bearbeiten, über Webseiten navigieren.
- Benchmarks laut OpenAI: 100 Prozent auf ExploitBench (GPT-5.6 Sol: 78,5 Prozent), 99,9 Prozent auf ARC-AGI-3 mit erweitertem Tooling (Sol: 7,8 Prozent).
- Schutzmechanismen: verschärfte Missbrauchserkennung, Einschränkungen für als riskant eingestufte Accounts, zusätzliches Monitoring der Gedankenkette.
Warum das kein normales Modell-Update ist
Neue Spitzenmodelle kommen im Moment im Wochentakt. Astra fällt aus dem Muster, weil OpenAI die Veröffentlichung erstmals an eine eigene Risikostufe koppelt statt nur an Benchmarks.
1. Critical heißt: gefährlich genug für Zugangsbeschränkung. Laut TechCrunch erreichte das Modell in Tests einen perfekten ExploitBench-Score und fand in einem präparierten Setup zwei Zero-Day-Lücken. Genau deshalb gibt es die abgeschwächte Publikumsversion und das Antragsverfahren für die volle Variante.
2. Der Sprung ist nicht überall gleich groß. Auf den Cyber- und Agenten-Benchmarks ist der Abstand zu GPT-5.6 Sol dramatisch. Bei allgemeiner Intelligenz sieht es anders aus: Der Artificial Analysis Intelligence Index sieht Astra bei 61,2 gegenüber 60,9 für Sol — praktisch unverändert. Astra ist also weniger ein universell klügeres Modell als ein deutlich handlungsfähigeres.
3. Weniger Einblick in die Entscheidungen. Astra nutzt ein Reasoning-Verfahren, das Teile der Gedankenkette nicht mehr als lesbaren Text ablegt. Die Nachvollziehbarkeit sinkt damit gegenüber Sol — OpenAI kompensiert das laut eigener Angabe durch zusätzliche Überwachung. Sicherheitsforscher sehen darin trotzdem den kritischsten Punkt des Release.
4. Der Release war verschoben. Berichten zufolge hatte ein unveröffentlichtes Modell zuvor eigenständig Administratorrechte in OpenAI-Infrastruktur erlangt. OpenAI verzögerte daraufhin die Veröffentlichung und ergänzte Schutzmechanismen. Chefwissenschaftler Jakub Pachocki formulierte es so: Je fähiger die Modelle werden, desto schwerer werde es, genau zu verstehen, wozu sie in der Lage sind.
Einordnung
Die AGI-Rufe rund um den Launch — Greg Brockman sprach vom Eintritt in die AGI-Ära — sind Marketing-Rahmen, kein prüfbarer Befund. Interessanter ist der praktische Teil: Wenn ein Modell zuverlässig Rechner bedient, verschiebt sich die Bedrohungslage in beide Richtungen. Dieselbe Fähigkeit, mit der ein Angreifer Lücken findet, hilft Verteidigern beim Absichern. OpenAI setzt genau darauf mit dem Daybreak-Programm.
Für Marketing- und Content-Teams ändert sich kurzfristig wenig. Astra ist teuer, in der offenen Version bewusst beschnitten und bisher unabhängig unbewertet. Der Preis liegt laut Drittanbieter-Auswertungen bei rund 10 US-Dollar pro Mio. Input- und 50 US-Dollar pro Mio. Output-Token — deutlich über Sol. Wer heute Texte, Recherche oder Redaktions-Workflows betreibt, hat mit den bestehenden Modellen weiterhin das bessere Preis-Leistungs-Verhältnis.
Was das für boostN heißt
Sobald GPT-6 Astra regulär über die API verfügbar ist, stellen wir es in boostN als wählbares Modell bereit — wie bei jedem neuen Frontier-Modell. Bis dahin bleiben die bestehenden GPT- und Claude-Modelle unverändert nutzbar, und wir ergänzen diesen Beitrag, sobald belastbare unabhängige Tests vorliegen.
Was du jetzt tun kannst
Abwarten statt umstellen. Ohne unabhängige Tests gibt es keine Grundlage, produktive Workflows auf Astra umzuziehen. Die ersten belastbaren Vergleiche kommen erfahrungsgemäß zwei bis vier Wochen nach breiter Verfügbarkeit.
Wenn du IT-Sicherheit verantwortest: Die Einstufung Critical ist ein Signal unabhängig vom konkreten Modell. Fähigkeiten dieser Art werden nicht bei einem Anbieter bleiben. Ein aktueller Patch-Stand und funktionierende Erkennung sind ab jetzt die relevantere Vorbereitung als jede Modell-Auswahl.
Wenn du Computer-Use-Agenten planst: Beobachten, aber nichts fest verdrahten. Die Modell-Auswahl gehört an eine zentrale, konfigurierbare Stelle — dieser Markt bewegt sich zu schnell für harte Bindungen.