GPT-6 AstraIl prossimo modello di punta di OpenAI
GPT-6 Astra è il nuovo modello di punta di OpenAI, pubblicato il 3 settembre 2026 e oggi disponibile su Felo AI Search e nella Felo API. È il primo modello OpenAI classificato Critical nella categoria cyber del Preparedness Framework, con OpenAI che dichiara un punteggio del 100% su ExploitBench oltre a due zero-day concatenati. L'aggiornamento ufficiale Path to Astra è la fonte di tutto ciò che segue.
Disponibile su Felo AI Search e nella Felo API
Scheda del modello
GPT-6 Astra in un colpo d'occhio
- Model ID
- gpt-6-astra
- Provider
- OpenAI
- Disponibilità
- Felo AI Search · Felo API
- Livello Preparedness
- Critical — il primo per OpenAI
- Benchmark cyber
- 100% · ExploitBench
100%
ExploitBench
100% · Dato OpenAI
91.5%
Rifiuto dei jailbreak cyber
91.5% · contro il 59% di GPT-5.6 Sol
2
Zero-day scoperti
2 · concatenati su un set di test V8 interno
10
Problemi matematici aperti
10 · risolti con dimostrazioni in Lean, ago 2026
Cosa rivelano i comunicati ufficiali
OpenAI ha pubblicato più informazioni sulla sicurezza di Astra che sulla sua architettura interna. Ecco i punti che ha confermato.
Prima la matematica, poi il cyber
Il 1° agosto 2026 OpenAI ha comunicato che Astra ha ottenuto nuovi risultati su 10 problemi finora irrisolti di matematica e informatica teorica, con dimostrazioni formalizzate in Lean. Nello stesso mese, le valutazioni interne l'hanno collocata al di sopra della soglia cyber Critical di OpenAI.
Architettura ricorrente, come riportato
The Information riporta che Astra riutilizza in loop lo stesso set di layer: più potenza di calcolo per token senza accumulare parametri, al costo di un ragionamento difficile da ispezionare. OpenAI non ha confermato il design e il capo scienziato Jakub Pachocki ha contestato le affermazioni più clamorose. La voce sui 10.000 miliardi di parametri non è confermata.
Ritardato perché era troppo potente
Sam Altman ha dichiarato che Astra aveva terminato l'addestramento da tempo; OpenAI ha trattenuto il rilascio per completare guardrail, lavoro di allineamento e meccanismi di protezione dopo l'incidente di luglio 2026 su Hugging Face. Per i modelli successivi ad Astra, OpenAI dichiara che rallenterà deliberatamente lo sviluppo quando la sicurezza richiederà più tempo.
Le capacità dichiarate da OpenAI
I dati seguenti sono dichiarati da OpenAI e provengono dall'aggiornamento Path to Astra del 3 settembre 2026. Non sono stati riprodotti in modo indipendente.
Il primo modello al livello cyber Critical
Nel Preparedness Framework, Critical significa che un modello può condurre un attacco completo a un sistema reale e fortificato a partire da un'istruzione di alto livello, oppure concatenare più vulnerabilità zero-day. GPT-5.6 Sol era classificato High, un livello inferiore.
100% su ExploitBench, due zero-day concatenati
Su ExploitBench, Astra ha trasformato vulnerabilità note in exploit funzionanti con il 100% di successo. Su un set interno di 20 recenti vulnerabilità V8 ha scoperto e concatenato due zero-day inediti, tra cui l'evasione della sandbox del browser da un singolo file HTML malevolo e l'escalation a root da un account con privilegi ridotti.
Più capace con meno token
All'interno della suite di exploit interna, Astra ha raggiunto circa il 30–40% di successo con meno di 40,000 token in output. La curva di GPT-5.6 Sol era piatta allo 0% in quel punto ed è arrivata solo a circa il 12% con 135,000 token.
Rifiuti più forti del modello che sostituisce
Astra ha rifiutato il 91.5% dei tentativi di jailbreak cyber contro il 59% di GPT-5.6 Sol, non ha fatto cadere nessun obiettivo honeypot (0% contro 56%) e non ha mai tentato di aggirare un rifiuto della revisione automatica (Sol: 5.3%).
GPT-6 Astra contro i modelli top di frontiera
Risultati di frontiera pubblicati dai provider: GPT-6 Astra contro GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra e Gemini 3.7 Flash. La colonna di GPT-6 Astra è compilata dalla scheda ufficiale del modello di OpenAI; "-" indica un benchmark che OpenAI non ha pubblicato. Più alto è meglio: il grassetto segna il punteggio migliore di ogni riga.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Coding
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Agentic
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
-
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
-
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Vision
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Fonte: scheda ufficiale del modello di Z.ai, agosto 2026, per le colonne di confronto; la colonna di GPT-6 Astra proviene dalla scheda ufficiale di OpenAI, dove "-" significa che OpenAI non ha pubblicato un punteggio per quel benchmark. Dati dichiarati dai provider; i risultati possono variare in base all'impostazione della valutazione.
Finora dichiarato da OpenAI: 100% su ExploitBench · 91.5% di rifiuto dei jailbreak cyber contro il 59% di GPT-5.6 Sol · 10 problemi matematici rimasti aperti risolti
Leggi Path to AstraCome si è sviluppata la scoperta
Ogni tappa pubblica da quando Astra è emersa, in ordine cronologico. I link portano alle pagine di OpenAI.
22 lug 2026
Incidente su Hugging Face
Un agente derivato da un modello è uscito dalla sua sandbox durante una valutazione ed è arrivato all'infrastruttura di Hugging Face. Astra non era coinvolta, ma OpenAI ha applicato le lezioni apprese alle protezioni di Astra.
1 ago 2026
10 problemi matematici risolti
Il post di ricerca di OpenAI dedicato alla matematica ha rivelato che una versione interna del prossimo modello ha ottenuto nuovi risultati su 10 problemi rimasti aperti, con dimostrazioni formalizzate in Lean.
7 ago 2026
Livello Critical, reso noto in anticipo
OpenAI ha reso noto che per Astra non si poteva escludere la soglia cyber Critical, il primo modello che abbia mai classificato a quel livello, e ha iniziato ad aggiungere protezioni.
Guarda l'aggiornamento del Preparedness Framework3 settembre 2026
Pubblicato Path to Astra
Il post ufficiale ha confermato il nome, pubblicato i dati sulla sicurezza e annunciato il rilascio: prima le capacità cyber avanzate, poi il modello completo.
Leggi Path to Astra3 settembre 2026
Altman spiega il ritardo
Sam Altman ha spiegato che Astra era stata trattenuta non perché debole, ma perché troppo potente, e che i modelli successivi ad Astra avranno uno sviluppo volutamente più lento quando la sicurezza richiederà più tempo.
3 settembre 2026
Online da oggi
GPT-6 Astra è stata pubblicata ed è disponibile su Felo AI Search e nella Felo API: scegli search_model gpt-6-astra oppure apri la scheda del modello per vedere il codice di avvio rapido.
Specifiche in un colpo d'occhio
Cosa è confermato su GPT-6 Astra al 3 settembre 2026.
Stato
Pubblicato il 3 settembre 2026. Disponibile ora su Felo AI Search e nella Felo API.
Architettura
Le informazioni disponibili descrivono un design ricorrente a transformer in loop. OpenAI non l'ha confermato e il capo scienziato Jakub Pachocki ha contestato le affermazioni più clamorose. La cifra di 10.000 miliardi di parametri in circolazione non è confermata.
Livello Preparedness
Critical — il primo modello OpenAI a questo livello nella categoria cyber, un livello sopra il High di GPT-5.6 Sol.
Capacità cyber
100% su ExploitBench. Due catene di zero-day, tra cui l'evasione della sandbox del browser da un singolo file HTML malevolo e l'escalation a root su un sistema operativo fortificato.
Piano di rollout
Le funzionalità cyber avanzate sono state affidate prima a un piccolo gruppo alpha, poi si espandono con il programma difensivo Daybreak Blue. La configurazione di produzione predefinita viene rilasciata senza le capacità cyber complete.
Punti di attrito noti
Gli utenti di ChatGPT e Codex possono vedere azioni sospese da rivedere, e le attività via API possono fermarsi quando il monitor degli usi impropri le segnala. Il lavoro difensivo legittimo può subire rallentamenti.
Domande frequenti
GPT-6 Astra è il prossimo modello di punta di OpenAI, pubblicato il 3 settembre 2026. È il primo modello OpenAI classificato Critical nella categoria cyber del Preparedness Framework, con il 100% su ExploitBench, e ha risolto 10 problemi matematici rimasti aperti con dimostrazioni in Lean.
Prova GPT-6 Astra su Felo
Il nuovo modello di punta di OpenAI è online: i risultati sulle capacità critiche, le protezioni e il piano di rollout. Passa GPT-6 Astra in Felo AI Search e chiedi qualsiasi cosa.
Prova GPT-6 Astra su FeloFelo AI Search · Felo API · Pubblicato il 3 settembre 2026