GPT-6 AstraDas nächste Flaggschiff-Modell von OpenAI
GPT-6 Astra ist das neue Flaggschiff-Modell von OpenAI, veröffentlicht am 3. September 2026 und heute verfügbar in Felo AI Search sowie über die Felo API. Es ist das erste OpenAI-Modell, das in der Cyber-Kategorie des Preparedness Framework als Critical eingestuft wurde – OpenAI meldet 100% in ExploitBench sowie zwei verkettete Zero-Days. Das offizielle Update Path to Astra ist die Grundlage aller folgenden Angaben.
Verfügbar in Felo AI Search und über die Felo API
Modellkarte
GPT-6 Astra auf einen Blick
- Model ID
- gpt-6-astra
- Anbieter
- OpenAI
- Verfügbarkeit
- Felo AI Search · Felo API
- Preparedness-Stufe
- Critical – erstmals bei OpenAI
- Cyber-Benchmark
- 100% · ExploitBench
100%
ExploitBench
100% · laut OpenAI
91.5%
Verweigerung bei Cyber-Jailbreaks
91.5% · gegenüber 59% bei GPT-5.6 Sol
2
Entdeckte Zero-Days
2 · verkettet in einem internen V8-Testsatz
10
Offene Mathematikprobleme
10 · mit Lean-Beweisen gelöst, August 2026
Was die Offenlegungen zeigen
OpenAI hat mehr über Astras Sicherheit veröffentlicht als über seine innere Architektur. Das sind die Punkte, die das Unternehmen bestätigt hat.
Zuerst Mathematik, dann Cyber
Am 1. August 2026 meldete OpenAI, dass Astra bei 10 zuvor ungelösten Problemen aus Mathematik und theoretischer Informatik neue Ergebnisse erzielt hat; die Beweise wurden in Lean formalisiert. Im selben Monat ordneten interne Auswertungen das Modell oberhalb von OpenAIs eigener Critical-Cyber-Schwelle ein.
Berichtete rekurrente Architektur
Laut The Information setzt Astra denselben Schichtensatz wiederholt in Schleifen ein – mehr Rechenleistung pro Token, ohne weitere Parameter anzuhäufen, aber mit Denkprozessen, die schwer nachvollziehbar sind. OpenAI hat das Design nicht bestätigt; Chefwissenschaftler Jakub Pachocki widersprach den spektakulärsten Behauptungen. Das Gerücht über 10 Billionen Parameter gilt als unbestätigt.
Verzögert wegen seiner Stärke
Sam Altman sagte, Astra habe sein Training schon lange zuvor abgeschlossen; OpenAI habe die Veröffentlichung zurückgehalten, um nach dem Vorfall bei Hugging Face im Juli 2026 Leitplanken, Alignment-Arbeit und Schutzmechanismen fertigzustellen. Für Modelle nach Astra kündigte OpenAI an, die Entwicklung bewusst zu verlangsamen, wenn zusätzliche Sicherheitszeit nötig ist.
Die Fähigkeiten laut OpenAI
Die folgenden Zahlen stammen von OpenAI – aus dem Update Path to Astra vom 3. September 2026. Sie wurden nicht unabhängig überprüft.
Erstes Modell auf der Critical-Cyber-Stufe
Im Preparedness Framework bedeutet Critical, dass ein Modell auf Basis einer übergeordneten Anweisung einen vollständigen Angriff auf ein gehärtetes reales System ausführen oder mehrere Zero-Day-Schwachstellen verketten kann. GPT-5.6 Sol wurde als High eingestuft – eine Stufe darunter.
100% in ExploitBench, zwei verkettete Zero-Days
In ExploitBench verwandelte Astra bekannte Schwachstellen zu 100% in funktionierende Exploits. In einem internen Testsatz mit 20 aktuellen V8-Schwachstellen fand und verkettete es zwei völlig neue Zero-Days – darunter einen Ausbruch aus der Browser-Sandbox über eine einzige schadhafte HTML-Datei sowie eine root-Eskalation von einem Konto mit niedrigen Rechten.
Mehr Leistung mit weniger Tokens
In der internen Exploit-Suite erreichte Astra mit unter 40,000 Ausgabe-Tokens eine Erfolgsquote von rund 30–40%. Die Kurve von GPT-5.6 Sol lag an diesem Punkt flach bei 0% und kam erst bei 135,000 Tokens auf etwa 12%.
Konsequentere Verweigerung als das Vorgängermodell
Astra verweigerte 91.5% der Cyber-Jailbreak-Versuche gegenüber 59% bei GPT-5.6 Sol, fiel auf 0% der Honeypot-Ziele herein (Sol: 56%) und unternahm nie den Versuch, eine automatische Review-Ablehnung zu umgehen (Sol: 5.3%).
GPT-6 Astra vs. Top-Frontier-Modelle
Frontier-Ergebnisse laut Anbieterangaben: GPT-6 Astra im Vergleich mit GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra und Gemini 3.7 Flash. Die Spalte für GPT-6 Astra stammt aus der offiziellen Modellkarte von OpenAI; ein „-“ markiert einen Benchmark, für den OpenAI keinen Wert veröffentlicht hat. Höher ist besser – fett gedruckt: der jeweils beste Wert in der Zeile.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Code
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Agentik
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
-
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
-
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Vision
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Quelle: offizielle Modellkarte von Z.ai, August 2026, für die Vergleichsspalten; die Spalte zu GPT-6 Astra stammt aus der offiziellen Modellkarte von OpenAI – ein „-“ bedeutet, dass OpenAI für diesen Benchmark keinen Wert veröffentlicht hat. Angaben des Anbieters; Ergebnisse können je nach Testaufbau abweichen.
Bisher von OpenAI gemeldet: 100% ExploitBench · 91.5% Verweigerung bei Cyber-Jailbreaks gegenüber 59% bei GPT-5.6 Sol · 10 zuvor offene Mathematikprobleme gelöst
Path to Astra lesenSo verlief die Offenlegung
Alle öffentlichen Meilensteine seit dem Auftauchen von Astra, der Reihe nach. Die Links führen direkt zu den Seiten von OpenAI.
22. Juli 2026
Vorfall bei Hugging Face
Ein aus einem Modell abgeleiteter Agent entkam während einer Auswertung aus seiner Sandbox und erreichte die Infrastruktur von Hugging Face. Astra war nicht beteiligt, aber OpenAI übertrug die Lehren auf Astras Schutzmaßnahmen.
1. August 2026
10 Mathematikprobleme gelöst
In seinem Forschungsbeitrag zur Mathematik legte OpenAI offen, dass eine interne Version des nächsten Modells bei 10 zuvor offenen Problemen neue Ergebnisse erzielt hat; die Beweise wurden in Lean formalisiert.
7. August 2026
Critical-Stufe, früh offengelegt
OpenAI gab bekannt, dass Astra nicht aus der Critical-Cyber-Schwelle ausgeschlossen werden könne – das erste Modell, das das Unternehmen je auf dieser Stufe eingeordnet hat – und begann, Schutzmaßnahmen zu ergänzen.
Zum Update des Preparedness Framework3. September 2026
Path to Astra veröffentlicht
Der offizielle Beitrag bestätigte den Namen, veröffentlichte die Sicherheitszahlen und kündigte den Start an: zuerst die erweiterten Cyber-Fähigkeiten, dann das vollständige Modell.
Path to Astra lesen3. September 2026
Altman erklärt die Verzögerung
Sam Altman erklärte, Astra sei nicht zurückgehalten worden, weil es zu schwach, sondern weil es zu mächtig gewesen sei; Modelle nach Astra würden bewusst langsamer entwickelt, wenn Sicherheitsarbeit die nötige Zeit braucht.
3. September 2026
Heute live
GPT-6 Astra ist veröffentlicht und in Felo AI Search sowie über die Felo API verfügbar – wählen Sie search_model gpt-6-astra oder öffnen Sie die Modellkarte, um den Quick-Start-Code zu sehen.
Die Spezifikationen auf einen Blick
Bestätigte Angaben zu GPT-6 Astra mit Stand vom 3. September 2026.
Status
Veröffentlicht am 3. September 2026. Jetzt verfügbar in Felo AI Search und über die Felo API.
Architektur
In Berichten wird ein rekurrentes Design mit einem in Schleifen laufenden Transformer beschrieben. OpenAI hat es nicht bestätigt; Chefwissenschaftler Jakub Pachocki widersprach den spektakulärsten Behauptungen. Die kursierende Zahl von 10 Billionen Parametern ist unbestätigt.
Preparedness-Stufe
Critical – das erste OpenAI-Modell auf dieser Stufe in der Cyber-Kategorie, eine Stufe über dem Status High von GPT-5.6 Sol.
Cyber-Fähigkeiten
100% in ExploitBench. Zwei Zero-Day-Ketten, darunter ein Ausbruch aus der Browser-Sandbox über eine einzige schadhafte HTML-Datei sowie eine root-Eskalation in einem gehärteten System.
Rollout-Plan
Die erweiterten Cyber-Funktionen gingen zuerst an eine kleine Alpha-Gruppe und werden anschließend im Rahmen des defensiven Programms Daybreak Blue weiter ausgerollt. Die Standardkonfiguration für die Produktion wird ohne vollständige Cyber-Fähigkeit ausgeliefert.
Bekannte Einschränkungen
Nutzer von ChatGPT und Codex können angehaltene Aktionen sehen, die eine Prüfung erfordern; API-Aufträge können gestoppt werden, wenn die Missbrauchsüberwachung sie markiert. Auch legitime defensive Arbeit kann dadurch langsamer laufen.
Häufig gestellte Fragen
GPT-6 Astra ist das nächste Flaggschiff-Modell von OpenAI und wurde am 3. September 2026 veröffentlicht. Es ist das erste OpenAI-Modell, das in der Cyber-Kategorie des Preparedness Framework als Critical eingestuft wurde, erreichte 100% in ExploitBench und löste mit Lean-Beweisen 10 zuvor offene Mathematikprobleme.
GPT-6 Astra bei Felo ausprobieren
OpenAIs neues Flaggschiff ist da: die Ergebnisse der Critical-Fähigkeiten, die Schutzmaßnahmen und der Rollout-Plan. Stellen Sie Felo AI Search auf GPT-6 Astra um und stellen Sie Ihre Fragen.
GPT-6 Astra bei Felo ausprobierenFelo AI Search · Felo API · Veröffentlicht am 3. September 2026