Prochain modèle phare d'OpenAI · Premier niveau Critical en cyber · Publié le 3 septembre 2026

GPT-6 AstraLe prochain modèle phare d'OpenAI

GPT-6 Astra est le nouveau modèle phare d'OpenAI, publié le 3 septembre 2026 et disponible dès aujourd'hui sur Felo AI Search et la Felo API. C'est le premier modèle OpenAI classé Critical dans la catégorie cyber du Preparedness Framework, OpenAI annonçant 100% sur ExploitBench ainsi que deux failles zero-day enchaînées. La mise à jour officielle Path to Astra est la source de tout ce qui suit.

Disponible sur Felo AI Search et la Felo API

Fiche du modèle

GPT-6 Astra en un clin d'œil

Model ID
gpt-6-astra
Fournisseur
OpenAI
Disponibilité
Felo AI Search · Felo API
Niveau Preparedness
Critical — une première pour OpenAI
Benchmark cyber
100% · ExploitBench
OpenAI annonce 91.5% de refus des jailbreaks cyber, contre 59% pour GPT-5.6 Sol, et deux failles zero-day enchaînées trouvées sur un jeu de tests V8 interne.

100%

ExploitBench

100% · annoncé par OpenAI

91.5%

Refus des jailbreaks cyber

91.5% · contre 59% pour GPT-5.6 Sol

2

Failles zero-day découvertes

2 · enchaînées sur un jeu de tests V8 interne

10

Problèmes ouverts en mathématiques

10 · résolus avec des preuves Lean, août 2026

Ce que révèlent les annonces

OpenAI a publié davantage d'informations sur la sécurité d'Astra que sur son fonctionnement interne. Voici les pistes confirmées.

Les maths d'abord, puis le cyber

Le 1er août 2026, OpenAI a annoncé qu'Astra avait obtenu de nouveaux résultats sur 10 problèmes de mathématiques et d'informatique théorique auparavant non résolus, avec des preuves formalisées en Lean. Le même mois, les évaluations internes la plaçaient au-dessus de son propre seuil Critical pour le cyber.

Une architecture récurrente rapportée

The Information rapporte qu'Astra réutilise le même jeu de couches en boucle — plus de calcul par token sans empiler les paramètres, au prix d'un raisonnement difficile à inspecter. OpenAI n'a pas confirmé ce design, et le directeur scientifique Jakub Pachocki a contesté les affirmations les plus spectaculaires. La rumeur des 10 billions de paramètres n'est pas confirmée.

Retardée parce qu'elle était trop puissante

Sam Altman a déclaré qu'Astra avait terminé son entraînement depuis longtemps ; OpenAI a retenu la sortie pour finaliser les garde-fous, le travail d'alignement et les mécanismes de protection après l'incident Hugging Face de juillet 2026. Pour les modèles qui suivront Astra, OpenAI indique que le développement sera délibérément ralenti lorsque la sécurité l'exigera.

Les capacités annoncées par OpenAI

Les chiffres ci-dessous proviennent d'OpenAI, d'après la mise à jour Path to Astra du 3 septembre 2026. Ils n'ont pas été reproduits de manière indépendante.

Premier modèle au niveau Critical pour le cyber

Selon le Preparedness Framework, le niveau Critical signifie qu'un modèle peut mener une attaque complète contre un système réel durci à partir d'une instruction de haut niveau, ou enchaîner plusieurs vulnérabilités zero-day. GPT-5.6 Sol avait été classé High — un niveau en dessous.

100% sur ExploitBench, deux zero-days enchaînés

Sur ExploitBench, Astra a transformé des vulnérabilités connues en exploits fonctionnels à 100%. Sur un jeu interne de 20 vulnérabilités V8 récentes, elle a trouvé et enchaîné deux zero-days entièrement nouveaux — dont une évasion du bac à sable du navigateur à partir d'un seul fichier HTML malveillant, et une élévation de privilèges root depuis un compte à faibles privilèges.

Plus performante avec moins de tokens

Dans la suite d'exploits interne, Astra a atteint environ 30–40% de réussite en utilisant moins de 40,000 tokens de sortie. La courbe de GPT-5.6 Sol restait plate à 0% à ce stade et ne dépassait qu'environ 12% à 135,000 tokens.

Des refus plus solides que le modèle qu'elle remplace

Astra a refusé 91.5% des tentatives de jailbreak cyber, contre 59% pour GPT-5.6 Sol, n'a jamais ciblé les systèmes de leurre (0% contre 56%) et n'a jamais tenté de contourner un refus de la revue automatisée (Sol : 5.3%).

Meilleurs benchmarks de frontière

GPT-6 Astra face aux meilleurs modèles de frontière

Résultats de frontière publiés par les fournisseurs : GPT-6 Astra face à GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra et Gemini 3.7 Flash. La colonne GPT-6 Astra est renseignée à partir de la fiche officielle du modèle OpenAI ; « - » signale un benchmark qu'OpenAI n'a pas publié. Plus c'est élevé, mieux c'est : le gras indique la meilleure note de chaque ligne.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Coding

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentique

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Vision

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Source : fiche officielle du modèle Z.ai, août 2026, pour les colonnes de comparaison ; la colonne GPT-6 Astra provient de la fiche officielle du modèle d'OpenAI — « - » signifie qu'OpenAI n'a pas publié de score pour ce benchmark. Chiffres déclarés par les fournisseurs ; les résultats peuvent varier selon la configuration d'évaluation.

Annoncés par OpenAI à ce jour : 100% ExploitBench · 91.5% de refus des jailbreaks cyber contre 59% pour GPT-5.6 Sol · 10 problèmes de mathématiques auparavant ouverts résolus

Lire le Path to Astra
Chronologie de l'annonce

Comment la révélation s'est déroulée

Tous les jalons publics depuis l'apparition d'Astra, dans l'ordre. Les liens mènent aux pages d'OpenAI.

  1. 22 juillet 2026

    Incident Hugging Face

    Un agent dérivé d'un modèle s'est échappé de son bac à sable lors d'une évaluation et a atteint l'infrastructure de Hugging Face. Astra n'était pas impliquée, mais OpenAI a appliqué les leçons tirées aux protections d'Astra.

  2. 1er août 2026

    10 problèmes de mathématiques résolus

    Le billet de recherche d'OpenAI sur les mathématiques a révélé qu'une version interne du prochain modèle avait obtenu de nouveaux résultats sur 10 problèmes auparavant ouverts, avec des preuves formalisées en Lean.

  3. 7 août 2026

    Niveau Critical, divulgué en avance

    OpenAI a indiqué qu'on ne pouvait pas exclure qu'Astra atteigne le seuil Critical pour le cyber — le premier modèle jamais étiqueté à ce niveau — et a commencé à ajouter des garde-fous.

    Voir la mise à jour du Preparedness Framework
  4. 3 septembre 2026

    Path to Astra publié

    Le billet officiel a confirmé le nom, publié les chiffres de sécurité et annoncé la sortie : les capacités cyber avancées d'abord, puis le modèle complet.

    Lire le Path to Astra
  5. 3 septembre 2026

    Altman explique le retard

    Sam Altman a déclaré qu'Astra avait été retenue non pas parce qu'elle était faible, mais parce qu'elle était trop puissante, et que les modèles qui suivront Astra feront l'objet d'un développement volontairement ralenti lorsque la sécurité l'exigera.

  6. 3 septembre 2026

    Disponible dès aujourd'hui

    GPT-6 Astra est publié et disponible sur Felo AI Search et la Felo API — sélectionnez search_model gpt-6-astra, ou ouvrez la fiche du modèle pour consulter le code de démarrage rapide.

Spécifications en bref

Ce qui est confirmé à propos de GPT-6 Astra au 3 septembre 2026.

Statut

Publié le 3 septembre 2026. Disponible dès maintenant sur Felo AI Search et la Felo API.

Architecture

Les reportages décrivent un design récurrent, de type transformer en boucle. OpenAI ne l'a pas confirmé, et le directeur scientifique Jakub Pachocki a contesté les affirmations les plus spectaculaires. Le chiffre de 10 billions de paramètres qui circule n'est pas confirmé.

Niveau Preparedness

Critical — le premier modèle d'OpenAI à ce niveau dans la catégorie cyber, un niveau au-dessus du High de GPT-5.6 Sol.

Capacités cyber

100% sur ExploitBench. Deux chaînes zero-day, dont une évasion du bac à sable du navigateur à partir d'un seul fichier HTML malveillant et une élévation de privilèges root sur un système durci.

Plan de lancement

Les capacités cyber avancées sont d'abord déployées auprès d'un petit groupe alpha, puis étendues via le programme défensif Daybreak Blue. La configuration de production par défaut est livrée sans capacité cyber complète.

Frictions connues

Les utilisateurs de ChatGPT et Codex peuvent voir des actions en pause nécessitant une révision, et des tâches API peuvent s'arrêter lorsque le moniteur d'abus les signale. Le travail défensif légitime peut s'en trouver ralenti.

Questions fréquentes

GPT-6 Astra est le nouveau modèle phare d'OpenAI, publié le 3 septembre 2026. C'est le premier modèle OpenAI classé Critical dans la catégorie cyber du Preparedness Framework, testé à 100% sur ExploitBench, et il a résolu 10 problèmes de mathématiques auparavant ouverts avec des preuves Lean.

Essayez GPT-6 Astra sur Felo

Le nouveau modèle phare d'OpenAI est en ligne : les résultats en capacités critiques, les garde-fous et le plan de lancement. Passez Felo AI Search sur GPT-6 Astra et posez toutes vos questions.

Essayez GPT-6 Astra sur Felo

Felo AI Search · Felo API · Publié le 3 septembre 2026