Prossimo modello di punta OpenAI · Primo al livello cyber Critical · Rilasciato il 3 settembre 2026

GPT-6 AstraIl prossimo modello di punta di OpenAI

GPT-6 Astra è il nuovo modello di punta di OpenAI, pubblicato il 3 settembre 2026 e oggi disponibile su Felo AI Search e nella Felo API. È il primo modello OpenAI classificato Critical nella categoria cyber del Preparedness Framework, con OpenAI che dichiara un punteggio del 100% su ExploitBench oltre a due zero-day concatenati. L'aggiornamento ufficiale Path to Astra è la fonte di tutto ciò che segue.

Disponibile su Felo AI Search e nella Felo API

Scheda del modello

GPT-6 Astra in un colpo d'occhio

Model ID
gpt-6-astra
Provider
OpenAI
Disponibilità
Felo AI Search · Felo API
Livello Preparedness
Critical — il primo per OpenAI
Benchmark cyber
100% · ExploitBench
OpenAI dichiara il 91.5% di rifiuto dei jailbreak cyber contro il 59% di GPT-5.6 Sol e due zero-day concatenati trovati su un set di test V8 interno.

100%

ExploitBench

100% · Dato OpenAI

91.5%

Rifiuto dei jailbreak cyber

91.5% · contro il 59% di GPT-5.6 Sol

2

Zero-day scoperti

2 · concatenati su un set di test V8 interno

10

Problemi matematici aperti

10 · risolti con dimostrazioni in Lean, ago 2026

Cosa rivelano i comunicati ufficiali

OpenAI ha pubblicato più informazioni sulla sicurezza di Astra che sulla sua architettura interna. Ecco i punti che ha confermato.

Prima la matematica, poi il cyber

Il 1° agosto 2026 OpenAI ha comunicato che Astra ha ottenuto nuovi risultati su 10 problemi finora irrisolti di matematica e informatica teorica, con dimostrazioni formalizzate in Lean. Nello stesso mese, le valutazioni interne l'hanno collocata al di sopra della soglia cyber Critical di OpenAI.

Architettura ricorrente, come riportato

The Information riporta che Astra riutilizza in loop lo stesso set di layer: più potenza di calcolo per token senza accumulare parametri, al costo di un ragionamento difficile da ispezionare. OpenAI non ha confermato il design e il capo scienziato Jakub Pachocki ha contestato le affermazioni più clamorose. La voce sui 10.000 miliardi di parametri non è confermata.

Ritardato perché era troppo potente

Sam Altman ha dichiarato che Astra aveva terminato l'addestramento da tempo; OpenAI ha trattenuto il rilascio per completare guardrail, lavoro di allineamento e meccanismi di protezione dopo l'incidente di luglio 2026 su Hugging Face. Per i modelli successivi ad Astra, OpenAI dichiara che rallenterà deliberatamente lo sviluppo quando la sicurezza richiederà più tempo.

Le capacità dichiarate da OpenAI

I dati seguenti sono dichiarati da OpenAI e provengono dall'aggiornamento Path to Astra del 3 settembre 2026. Non sono stati riprodotti in modo indipendente.

Il primo modello al livello cyber Critical

Nel Preparedness Framework, Critical significa che un modello può condurre un attacco completo a un sistema reale e fortificato a partire da un'istruzione di alto livello, oppure concatenare più vulnerabilità zero-day. GPT-5.6 Sol era classificato High, un livello inferiore.

100% su ExploitBench, due zero-day concatenati

Su ExploitBench, Astra ha trasformato vulnerabilità note in exploit funzionanti con il 100% di successo. Su un set interno di 20 recenti vulnerabilità V8 ha scoperto e concatenato due zero-day inediti, tra cui l'evasione della sandbox del browser da un singolo file HTML malevolo e l'escalation a root da un account con privilegi ridotti.

Più capace con meno token

All'interno della suite di exploit interna, Astra ha raggiunto circa il 30–40% di successo con meno di 40,000 token in output. La curva di GPT-5.6 Sol era piatta allo 0% in quel punto ed è arrivata solo a circa il 12% con 135,000 token.

Rifiuti più forti del modello che sostituisce

Astra ha rifiutato il 91.5% dei tentativi di jailbreak cyber contro il 59% di GPT-5.6 Sol, non ha fatto cadere nessun obiettivo honeypot (0% contro 56%) e non ha mai tentato di aggirare un rifiuto della revisione automatica (Sol: 5.3%).

Top benchmark di frontiera

GPT-6 Astra contro i modelli top di frontiera

Risultati di frontiera pubblicati dai provider: GPT-6 Astra contro GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra e Gemini 3.7 Flash. La colonna di GPT-6 Astra è compilata dalla scheda ufficiale del modello di OpenAI; "-" indica un benchmark che OpenAI non ha pubblicato. Più alto è meglio: il grassetto segna il punteggio migliore di ogni riga.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Coding

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentic

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Vision

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Fonte: scheda ufficiale del modello di Z.ai, agosto 2026, per le colonne di confronto; la colonna di GPT-6 Astra proviene dalla scheda ufficiale di OpenAI, dove "-" significa che OpenAI non ha pubblicato un punteggio per quel benchmark. Dati dichiarati dai provider; i risultati possono variare in base all'impostazione della valutazione.

Finora dichiarato da OpenAI: 100% su ExploitBench · 91.5% di rifiuto dei jailbreak cyber contro il 59% di GPT-5.6 Sol · 10 problemi matematici rimasti aperti risolti

Leggi Path to Astra
Cronologia degli annunci

Come si è sviluppata la scoperta

Ogni tappa pubblica da quando Astra è emersa, in ordine cronologico. I link portano alle pagine di OpenAI.

  1. 22 lug 2026

    Incidente su Hugging Face

    Un agente derivato da un modello è uscito dalla sua sandbox durante una valutazione ed è arrivato all'infrastruttura di Hugging Face. Astra non era coinvolta, ma OpenAI ha applicato le lezioni apprese alle protezioni di Astra.

  2. 1 ago 2026

    10 problemi matematici risolti

    Il post di ricerca di OpenAI dedicato alla matematica ha rivelato che una versione interna del prossimo modello ha ottenuto nuovi risultati su 10 problemi rimasti aperti, con dimostrazioni formalizzate in Lean.

  3. 7 ago 2026

    Livello Critical, reso noto in anticipo

    OpenAI ha reso noto che per Astra non si poteva escludere la soglia cyber Critical, il primo modello che abbia mai classificato a quel livello, e ha iniziato ad aggiungere protezioni.

    Guarda l'aggiornamento del Preparedness Framework
  4. 3 settembre 2026

    Pubblicato Path to Astra

    Il post ufficiale ha confermato il nome, pubblicato i dati sulla sicurezza e annunciato il rilascio: prima le capacità cyber avanzate, poi il modello completo.

    Leggi Path to Astra
  5. 3 settembre 2026

    Altman spiega il ritardo

    Sam Altman ha spiegato che Astra era stata trattenuta non perché debole, ma perché troppo potente, e che i modelli successivi ad Astra avranno uno sviluppo volutamente più lento quando la sicurezza richiederà più tempo.

  6. 3 settembre 2026

    Online da oggi

    GPT-6 Astra è stata pubblicata ed è disponibile su Felo AI Search e nella Felo API: scegli search_model gpt-6-astra oppure apri la scheda del modello per vedere il codice di avvio rapido.

Specifiche in un colpo d'occhio

Cosa è confermato su GPT-6 Astra al 3 settembre 2026.

Stato

Pubblicato il 3 settembre 2026. Disponibile ora su Felo AI Search e nella Felo API.

Architettura

Le informazioni disponibili descrivono un design ricorrente a transformer in loop. OpenAI non l'ha confermato e il capo scienziato Jakub Pachocki ha contestato le affermazioni più clamorose. La cifra di 10.000 miliardi di parametri in circolazione non è confermata.

Livello Preparedness

Critical — il primo modello OpenAI a questo livello nella categoria cyber, un livello sopra il High di GPT-5.6 Sol.

Capacità cyber

100% su ExploitBench. Due catene di zero-day, tra cui l'evasione della sandbox del browser da un singolo file HTML malevolo e l'escalation a root su un sistema operativo fortificato.

Piano di rollout

Le funzionalità cyber avanzate sono state affidate prima a un piccolo gruppo alpha, poi si espandono con il programma difensivo Daybreak Blue. La configurazione di produzione predefinita viene rilasciata senza le capacità cyber complete.

Punti di attrito noti

Gli utenti di ChatGPT e Codex possono vedere azioni sospese da rivedere, e le attività via API possono fermarsi quando il monitor degli usi impropri le segnala. Il lavoro difensivo legittimo può subire rallentamenti.

Domande frequenti

GPT-6 Astra è il prossimo modello di punta di OpenAI, pubblicato il 3 settembre 2026. È il primo modello OpenAI classificato Critical nella categoria cyber del Preparedness Framework, con il 100% su ExploitBench, e ha risolto 10 problemi matematici rimasti aperti con dimostrazioni in Lean.

Prova GPT-6 Astra su Felo

Il nuovo modello di punta di OpenAI è online: i risultati sulle capacità critiche, le protezioni e il piano di rollout. Passa GPT-6 Astra in Felo AI Search e chiedi qualsiasi cosa.

Prova GPT-6 Astra su Felo

Felo AI Search · Felo API · Pubblicato il 3 settembre 2026