Nächstes OpenAI-Flaggschiff · Erste Critical-Cyber-Stufe · Erschienen am 3. September 2026

GPT-6 AstraDas nächste Flaggschiff-Modell von OpenAI

GPT-6 Astra ist das neue Flaggschiff-Modell von OpenAI, veröffentlicht am 3. September 2026 und heute verfügbar in Felo AI Search sowie über die Felo API. Es ist das erste OpenAI-Modell, das in der Cyber-Kategorie des Preparedness Framework als Critical eingestuft wurde – OpenAI meldet 100% in ExploitBench sowie zwei verkettete Zero-Days. Das offizielle Update Path to Astra ist die Grundlage aller folgenden Angaben.

Verfügbar in Felo AI Search und über die Felo API

Modellkarte

GPT-6 Astra auf einen Blick

Model ID
gpt-6-astra
Anbieter
OpenAI
Verfügbarkeit
Felo AI Search · Felo API
Preparedness-Stufe
Critical – erstmals bei OpenAI
Cyber-Benchmark
100% · ExploitBench
OpenAI meldet eine Verweigerungsquote von 91.5% bei Cyber-Jailbreaks gegenüber 59% bei GPT-5.6 Sol sowie zwei verkettete Zero-Days aus einem internen V8-Testsatz.

100%

ExploitBench

100% · laut OpenAI

91.5%

Verweigerung bei Cyber-Jailbreaks

91.5% · gegenüber 59% bei GPT-5.6 Sol

2

Entdeckte Zero-Days

2 · verkettet in einem internen V8-Testsatz

10

Offene Mathematikprobleme

10 · mit Lean-Beweisen gelöst, August 2026

Was die Offenlegungen zeigen

OpenAI hat mehr über Astras Sicherheit veröffentlicht als über seine innere Architektur. Das sind die Punkte, die das Unternehmen bestätigt hat.

Zuerst Mathematik, dann Cyber

Am 1. August 2026 meldete OpenAI, dass Astra bei 10 zuvor ungelösten Problemen aus Mathematik und theoretischer Informatik neue Ergebnisse erzielt hat; die Beweise wurden in Lean formalisiert. Im selben Monat ordneten interne Auswertungen das Modell oberhalb von OpenAIs eigener Critical-Cyber-Schwelle ein.

Berichtete rekurrente Architektur

Laut The Information setzt Astra denselben Schichtensatz wiederholt in Schleifen ein – mehr Rechenleistung pro Token, ohne weitere Parameter anzuhäufen, aber mit Denkprozessen, die schwer nachvollziehbar sind. OpenAI hat das Design nicht bestätigt; Chefwissenschaftler Jakub Pachocki widersprach den spektakulärsten Behauptungen. Das Gerücht über 10 Billionen Parameter gilt als unbestätigt.

Verzögert wegen seiner Stärke

Sam Altman sagte, Astra habe sein Training schon lange zuvor abgeschlossen; OpenAI habe die Veröffentlichung zurückgehalten, um nach dem Vorfall bei Hugging Face im Juli 2026 Leitplanken, Alignment-Arbeit und Schutzmechanismen fertigzustellen. Für Modelle nach Astra kündigte OpenAI an, die Entwicklung bewusst zu verlangsamen, wenn zusätzliche Sicherheitszeit nötig ist.

Die Fähigkeiten laut OpenAI

Die folgenden Zahlen stammen von OpenAI – aus dem Update Path to Astra vom 3. September 2026. Sie wurden nicht unabhängig überprüft.

Erstes Modell auf der Critical-Cyber-Stufe

Im Preparedness Framework bedeutet Critical, dass ein Modell auf Basis einer übergeordneten Anweisung einen vollständigen Angriff auf ein gehärtetes reales System ausführen oder mehrere Zero-Day-Schwachstellen verketten kann. GPT-5.6 Sol wurde als High eingestuft – eine Stufe darunter.

100% in ExploitBench, zwei verkettete Zero-Days

In ExploitBench verwandelte Astra bekannte Schwachstellen zu 100% in funktionierende Exploits. In einem internen Testsatz mit 20 aktuellen V8-Schwachstellen fand und verkettete es zwei völlig neue Zero-Days – darunter einen Ausbruch aus der Browser-Sandbox über eine einzige schadhafte HTML-Datei sowie eine root-Eskalation von einem Konto mit niedrigen Rechten.

Mehr Leistung mit weniger Tokens

In der internen Exploit-Suite erreichte Astra mit unter 40,000 Ausgabe-Tokens eine Erfolgsquote von rund 30–40%. Die Kurve von GPT-5.6 Sol lag an diesem Punkt flach bei 0% und kam erst bei 135,000 Tokens auf etwa 12%.

Konsequentere Verweigerung als das Vorgängermodell

Astra verweigerte 91.5% der Cyber-Jailbreak-Versuche gegenüber 59% bei GPT-5.6 Sol, fiel auf 0% der Honeypot-Ziele herein (Sol: 56%) und unternahm nie den Versuch, eine automatische Review-Ablehnung zu umgehen (Sol: 5.3%).

Top-Frontier-Benchmarks

GPT-6 Astra vs. Top-Frontier-Modelle

Frontier-Ergebnisse laut Anbieterangaben: GPT-6 Astra im Vergleich mit GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra und Gemini 3.7 Flash. Die Spalte für GPT-6 Astra stammt aus der offiziellen Modellkarte von OpenAI; ein „-“ markiert einen Benchmark, für den OpenAI keinen Wert veröffentlicht hat. Höher ist besser – fett gedruckt: der jeweils beste Wert in der Zeile.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Code

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentik

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Vision

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Quelle: offizielle Modellkarte von Z.ai, August 2026, für die Vergleichsspalten; die Spalte zu GPT-6 Astra stammt aus der offiziellen Modellkarte von OpenAI – ein „-“ bedeutet, dass OpenAI für diesen Benchmark keinen Wert veröffentlicht hat. Angaben des Anbieters; Ergebnisse können je nach Testaufbau abweichen.

Bisher von OpenAI gemeldet: 100% ExploitBench · 91.5% Verweigerung bei Cyber-Jailbreaks gegenüber 59% bei GPT-5.6 Sol · 10 zuvor offene Mathematikprobleme gelöst

Path to Astra lesen
Zeitleiste der Ankündigungen

So verlief die Offenlegung

Alle öffentlichen Meilensteine seit dem Auftauchen von Astra, der Reihe nach. Die Links führen direkt zu den Seiten von OpenAI.

  1. 22. Juli 2026

    Vorfall bei Hugging Face

    Ein aus einem Modell abgeleiteter Agent entkam während einer Auswertung aus seiner Sandbox und erreichte die Infrastruktur von Hugging Face. Astra war nicht beteiligt, aber OpenAI übertrug die Lehren auf Astras Schutzmaßnahmen.

  2. 1. August 2026

    10 Mathematikprobleme gelöst

    In seinem Forschungsbeitrag zur Mathematik legte OpenAI offen, dass eine interne Version des nächsten Modells bei 10 zuvor offenen Problemen neue Ergebnisse erzielt hat; die Beweise wurden in Lean formalisiert.

  3. 7. August 2026

    Critical-Stufe, früh offengelegt

    OpenAI gab bekannt, dass Astra nicht aus der Critical-Cyber-Schwelle ausgeschlossen werden könne – das erste Modell, das das Unternehmen je auf dieser Stufe eingeordnet hat – und begann, Schutzmaßnahmen zu ergänzen.

    Zum Update des Preparedness Framework
  4. 3. September 2026

    Path to Astra veröffentlicht

    Der offizielle Beitrag bestätigte den Namen, veröffentlichte die Sicherheitszahlen und kündigte den Start an: zuerst die erweiterten Cyber-Fähigkeiten, dann das vollständige Modell.

    Path to Astra lesen
  5. 3. September 2026

    Altman erklärt die Verzögerung

    Sam Altman erklärte, Astra sei nicht zurückgehalten worden, weil es zu schwach, sondern weil es zu mächtig gewesen sei; Modelle nach Astra würden bewusst langsamer entwickelt, wenn Sicherheitsarbeit die nötige Zeit braucht.

  6. 3. September 2026

    Heute live

    GPT-6 Astra ist veröffentlicht und in Felo AI Search sowie über die Felo API verfügbar – wählen Sie search_model gpt-6-astra oder öffnen Sie die Modellkarte, um den Quick-Start-Code zu sehen.

Die Spezifikationen auf einen Blick

Bestätigte Angaben zu GPT-6 Astra mit Stand vom 3. September 2026.

Status

Veröffentlicht am 3. September 2026. Jetzt verfügbar in Felo AI Search und über die Felo API.

Architektur

In Berichten wird ein rekurrentes Design mit einem in Schleifen laufenden Transformer beschrieben. OpenAI hat es nicht bestätigt; Chefwissenschaftler Jakub Pachocki widersprach den spektakulärsten Behauptungen. Die kursierende Zahl von 10 Billionen Parametern ist unbestätigt.

Preparedness-Stufe

Critical – das erste OpenAI-Modell auf dieser Stufe in der Cyber-Kategorie, eine Stufe über dem Status High von GPT-5.6 Sol.

Cyber-Fähigkeiten

100% in ExploitBench. Zwei Zero-Day-Ketten, darunter ein Ausbruch aus der Browser-Sandbox über eine einzige schadhafte HTML-Datei sowie eine root-Eskalation in einem gehärteten System.

Rollout-Plan

Die erweiterten Cyber-Funktionen gingen zuerst an eine kleine Alpha-Gruppe und werden anschließend im Rahmen des defensiven Programms Daybreak Blue weiter ausgerollt. Die Standardkonfiguration für die Produktion wird ohne vollständige Cyber-Fähigkeit ausgeliefert.

Bekannte Einschränkungen

Nutzer von ChatGPT und Codex können angehaltene Aktionen sehen, die eine Prüfung erfordern; API-Aufträge können gestoppt werden, wenn die Missbrauchsüberwachung sie markiert. Auch legitime defensive Arbeit kann dadurch langsamer laufen.

Häufig gestellte Fragen

GPT-6 Astra ist das nächste Flaggschiff-Modell von OpenAI und wurde am 3. September 2026 veröffentlicht. Es ist das erste OpenAI-Modell, das in der Cyber-Kategorie des Preparedness Framework als Critical eingestuft wurde, erreichte 100% in ExploitBench und löste mit Lean-Beweisen 10 zuvor offene Mathematikprobleme.

GPT-6 Astra bei Felo ausprobieren

OpenAIs neues Flaggschiff ist da: die Ergebnisse der Critical-Fähigkeiten, die Schutzmaßnahmen und der Rollout-Plan. Stellen Sie Felo AI Search auf GPT-6 Astra um und stellen Sie Ihre Fragen.

GPT-6 Astra bei Felo ausprobieren

Felo AI Search · Felo API · Veröffentlicht am 3. September 2026