Prima fascia Critical in ambito cyber · Rilasciato il 3 settembre 2026

GPT-6 Astra

GPT-6 Astra è il nuovo modello di punta di OpenAI, rilasciato il 3 settembre 2026 e già disponibile su Felo AI Search e Felo API.

100%
ExploitBench
100% · contro il 78.5% di GPT-5.6 Sol
98%
FrontierMath Tier 4
98% · satura la fascia · ARC-AGI-3 99.9%
2
Zero-day scoperti
2 · individuati nella valutazione interna ExploitBench di OpenAI e segnalati ai manutentori
59.3%
Agents' Last Exam
59.3% · il migliore del confronto · 65% di token di output in meno rispetto a Opus 5

Cosa rivelano le comunicazioni ufficiali

OpenAI ha pubblicato più informazioni sulla sicurezza di Astra che sui suoi interni. Ecco i filoni che ha confermato.

Diagramma in stile tecnico di quattro blocchi di livelli identici in fila con un ciclo di retroazione
Diagramma illustrativo. The Information riporta questa architettura ricorrente; OpenAI non l'ha confermata.
01

Prima la matematica, poi la cyber

Il 1° agosto 2026 OpenAI ha riportato che Astra ha ottenuto nuovi risultati su 10 problemi di matematica e informatica teorica rimasti irrisolti, con dimostrazioni formalizzate in Lean. Il 4 settembre ha condiviso altri due risultati sui divari tra numeri primi: un limite di 186 sui divari brevi, migliorato da 246, poi dai 240 di Julia Stadlmann, e un miglioramento a un termine del limite storico sui divari insolitamente ampi tra numeri primi, rimasto invariato per più di 80 anni. FrontierMath Tier 4 è saturato al 98%. Nello stesso mese, le valutazioni interne lo hanno collocato al di sopra della soglia Critical cyber di OpenAI.

02

L'architettura ricorrente, secondo i report

The Information riporta che Astra riusa lo stesso set di layer in loop: più compute per token senza accumulare parametri, al prezzo di un ragionamento difficile da ispezionare. La pagina prodotto di OpenAI non rivela l'architettura né il numero di parametri, non ha confermato il progetto, e il chief scientist Jakub Pachocki ha contestato le affermazioni più sensazionali. La voce dei 10 trilioni di parametri non è confermata.

03

Ritardato perché era troppo forte

Sam Altman ha dichiarato che Astra ha terminato l'addestramento molto tempo fa; OpenAI ha trattenuto il rilascio per completare guardrail, lavoro di allineamento e meccanismi di protezione dopo l'incidente Hugging Face del luglio 2026. Per i modelli successivi ad Astra, OpenAI afferma che rallenterà intenzionalmente lo sviluppo quando la sicurezza richiederà più tempo.

Le capacità dichiarate da OpenAI

I dati seguenti sono dichiarati da OpenAI: provengono dall'aggiornamento sulla sicurezza del 3 settembre e dalla pagina prodotto del 4 settembre. Non sono stati riprodotti in modo indipendente.

Il primo modello alla fascia Critical in ambito cyber

Nel Preparedness Framework, Critical significa che un modello può eseguire un attacco completo a un sistema reale rinforzato partendo da un'istruzione di alto livello, oppure combinare più vulnerabilità zero-day. GPT-5.6 Sol era classificato High, una fascia sotto. Astra è anche il modello più allineato di OpenAI: in una valutazione che tiene conto dell'incidente Hugging Face, ha superato il proprio obiettivo autorizzato nello 0% dei casi contro il 48% di GPT-5.6 Sol, e nel test di stress sulla sicurezza dell'uso del computer della pagina del modello il suo tasso di esiti disallineati è stato del 2.4% contro il 22.0% di Sol, con il 9.5% per Claude Fable 5.1, il 18.3% per Fable 5 e l'11.5% per Opus 5, il più basso tra i modelli di frontiera testati.

100% su ExploitBench, zero-day scoperti

Senza le protezioni di produzione, Astra ha ottenuto il 100% su ExploitBench (78.5% per GPT-5.6 Sol) e il 42.4% su ExploitGym (30.3% per Sol). Sul nuovo dataset ExploitBench (giugno-agosto 2026), costruito sulle vulnerabilità dei tre mesi precedenti, ha raggiunto il 39.0% contro il 5.5% di Sol, e durante quella valutazione ha scoperto e utilizzato due zero-day fino ad allora sconosciuti, che OpenAI sta comunicando ai loro manutentori. Le valutazioni degli esperti hanno rilevato esecuzione di codice arbitrario in browser rinforzati ed exploit di escalation dei privilegi su sistemi operativi rinforzati.

Più capace con meno token

Agli Agents' Last Exam, Astra ha ottenuto il 59.3% usando circa il 65% di token di output in meno rispetto a Opus 5. Su OSWorld 2.0 arriva al 72.6% in circa 40 minuti per attività, contro il 65.7% in circa 75 minuti di GPT-5.6 Sol: 47% di tempo in meno. In Codex, la combinazione completa le attività Mind2Web 1.9 volte più velocemente, e OpenAI riporta costi API inferiori di circa il 9-86% sui benchmark in cui è in testa. Astra riesce inoltre a conservare le note tra una finestra di contesto e l'altra in Codex, preservando i dettagli accumulati invece di compattarli ripetutamente in un unico riassunto, oggi in via sperimentale e attivabile tramite config.toml, diventerà il comportamento predefinito di Astra nelle prossime settimane, mentre le finestre di contesto precedenti resteranno ricercabili.

Rifiuti più netti del modello che sostituisce

Astra ha rifiutato il 91.5% dei tentativi di jailbreak cyber contro il 59% di GPT-5.6 Sol, non ha aggredito alcun obiettivo honeypot nello 0% dei casi contro il 56%, non ha mai provato ad aggirare un diniego della revisione automatizzata (Sol: 5.3%) ed è tre volte meno incline a fare affermazioni inesatte sulle proprie capacità. Nelle valutazioni interne della pagina del modello ha poi ottenuto lo 0.00% contro lo 0.29% di Sol sul benchmark dell'aggiramento e il 4.2% contro il 12.2% sulle allucinazioni di capacità.

GPT-6 Astra contro i migliori modelli di frontiera

Risultati di frontiera pubblicati dai provider: GPT-6 Astra contro GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra e Gemini 3.7 Flash. La colonna di GPT-6 Astra è compilata dalla pagina modello e dall'aggiornamento sulla sicurezza di OpenAI; "-" indica un benchmark che OpenAI non ha pubblicato per Astra. Più alto è meglio: il grassetto indica il punteggio migliore di ogni riga.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Coding

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentic

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

41.5

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

59.3

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Vision

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Fonte: scheda modello ufficiale di Z.ai, agosto 2026, per le colonne di confronto; la colonna di GPT-6 Astra proviene dalla pagina modello e dall'aggiornamento sulla sicurezza di OpenAI (3-4 settembre 2026). Il "-" indica che OpenAI non ha pubblicato quel benchmark per Astra. Dati dichiarati dai provider; i risultati possono variare in base all'esecuzione della valutazione.

Dichiarati da OpenAI: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (99.2% entro quattro tentativi) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench

Leggi la pagina di OpenAI su GPT-6 Astra

Curve ufficiali costo-precisione

OpenAI ha tracciato il costo dell'API rispetto alla precisione nella pagina del modello. Il grafico sotto copre solo GPT-6 Astra e GPT-5.6 Sol; la tabella elenca il miglior punteggio riportato per tutti e cinque i modelli.

0%25%50%75%100%$0.05$0.5$5$20Costo API (log)GPT-6 AstraGPT-5.6 Sol

Benchmark

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

OSWorld 2.0 · Offline

75.5% @ $9

65.5% @ $8.5

-

-

70% @ $24.5

ScreenSpot-Pro

93% @ $0.09

77% @ $0.045

-

-

-

Agents' Last Exam

59.3% @ $8

53.5% @ $4

-

48.5% (reported)

55.5% (reported)

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

Terminal-Bench 4.0

57.5% @ $6.5

37.5% @ $8.5

56% @ $21

45% (reported)

52.5% (reported)

FrontierMath Tier 4 (v2)

97.5% @ $1

78% @ $0.4

87.5% (reported)

78% @ $4.75

72.5% (reported)

ARC-AGI-3

99.9%

7.8%

-

-

30.2%

Terminal-Bench Science 0.1

64.6% @ $35

22.5% (reported)

52.5% @ $35

21% (reported)

30% (reported)

AutomationBench

41.5% @ $1.75

18% @ $1.15

31% (reported)

17.5% @ $3.65

26.5% (reported)

Fonte: pagina del modello GPT-6 Astra di OpenAI (4 settembre 2026). "@ $X" è il costo API in corrispondenza del punteggio migliore; "dichiarato" segna un singolo punteggio riportato senza curva dei costi. ExploitGym honeypot è l'unica metrica in cui un valore più basso è migliore.

La tabella di confronto ufficiale completa

La tabella completa dalla pagina di OpenAI su GPT-6 Astra: nove categorie, 40 benchmark, sei modelli. Ogni punteggio è il massimo a qualsiasi livello di sforzo; "-" significa che OpenAI non ha riportato quel benchmark per quel modello. Le cifre in apice rimandano alle note a piè di pagina della pagina di OpenAI.

Benchmark

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

Gemini 3.8 Flash

Uso del computer

Agents' Last Exam

59.3%

53.6%

-

48.7%

55.5%

-

OSWorld 2.0 (v2026.08.08, offline set, partial score)

72.6%

65.7%

-

-

70.2%³

-

ScreenSpot-Pro (no tools)

92.7%

76.9%

-

87.3%¹⁷

-

-

Lavoro professionale

AutomationBench

41.4%

18.1%

31.4%

17.4%

26.9%

-

BenchCAD

95.9%

83.3%

84.3%⁵

67.5%⁵

82.1%⁵

-

BrowseComp

91.5%

90.4%

-

87.4%

90.8%

-

OpenScore String Quartets (1 - OMR-NED)

0.84

0.19

-

-

-

-

Internal Design Tasks

50.0%

47.4%

-

35.8%

-

-

Internal Data Science Tasks

40.9%

30.5%

-

34.7%

-

-

Artificial Analysis Intelligence Index v4.1.1

61.2

60.9

65.7

62.1

63.1

58.7

Coding

Terminal-Bench 4.0

57.9%

37.3%

55.8%

44.5%

52.6%

19.1%

DeepSWE v1.1

74.1%

72.7%

67.4%

69.9%

73.7%

73.8%

FrontierCode 1.1 Extended (score)

64.5%⁸

60.6%

63.6%

64.9%

63.6%

56.3%

FrontierCode 1.1 Main (score)

53.3%⁸

47.5%

50.9%

53.5%

53.4%

43.6%

Internal Database Migration Tasks

63.9%

42.7%

57.8%

50.3%

-

-

Artificial Analysis Coding Agent Index v1.4

67.0

65.1

-

67.2

68.1

61.2

Accademico

Terminal-Bench Science 0.1

64.6%

22.4%

52.6%

21.4%

30.0%

-

FrontierMath Tier 4 (v2)

97.6%

83.0%

87.8%

87.8%

73.2%

-

GPQA Diamond

96.0%

94.6%

93.7%

92.6%

93.7%

95.3%

Humanity's Last Exam (w/ tools)

57.2%

-

65.0%

63.8%

63.6%

-

Scienza e salute

GeneBench Pro

37.1%

32.3%

-

-

-

-

MedChemBench (Internal)

49.3%

47.4%

-

-

-

-

LifeSciBench

60.3%

59.9%

-

-

-

-

HealthBench Professional (length-adjusted)

63.4%

60.5%

58.1%¹¹

60.9%¹¹

56.4%¹¹

52.1%

Cybersecurity

ExploitBench

100.0%

78.5%

-

-

70%

-

ExploitGym

42.4%¹³

30.3%¹³

30.4%¹⁷

28.4%¹⁷

22.0%

-

ExploitBench (June-August 2026)

39.0%

5.5%

-

-

-

-

SRE-Bench

88.0%

55.9%

-

-

12.5%

-

SEC-Bench Pro

85.4%

79.1%

-

-

-

-

Allineamento

Internal computer use safety benchmark (lower is better)

2.4%

22.0%

9.5%

18.3%

11.5%

-

Internal computer use safety benchmark, w/ AutoReview (lower is better)

1.8%

4.3%

-

-

-

-

Internal circumvention benchmark (lower is better)

0.00%

0.29%

-

-

-

-

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

-

Impossible ExploitGym

100.0%

-

-

-

-

-

Internal hallucination benchmark (lower is better)

4.2%

12.2%

-

-

-

-

Contesto lungo

OpenAI MRCR v2 8-needle 256K-512K

100.0%

91.5%

-

-

-

-

OpenAI MRCR v2 8-needle 512K-1M

96.3%

73.8%

-

-

-

-

Ragionamento astratto

ARC-AGI-3

99.9%¹

7.8%

-

-

30.2%

-

ARC-AGI-2

95.0%

92.5%

90.0%

89.2%

90.4%

-

ARC-AGI-1

98.5%

97.5%

97.5%

98.5%

97.5%

-

Fonte: pagina del modello GPT-6 Astra di OpenAI (4 settembre 2026). Le cifre in apice sono i richiami di nota di OpenAI: ¹ ARC-AGI-3 è stato eseguito con l'harness della Responses API; ³ il punteggio OSWorld 2.0 di Opus 5 è stato riprodotto dagli autori del benchmark sulla classifica ufficiale; ⁵ i punteggi BenchCAD di Claude riflettono tre modifiche alla valutazione; ⁸ i punteggi FrontierCode di Astra hanno utilizzato un messaggio dello sviluppatore che rispecchia la configurazione Codex; ¹¹ i punteggi HealthBench Professional dei modelli Claude sono stati valutati autonomamente da OpenAI; ¹³ ExploitGym è stato eseguito senza il limite di tempo di 6 ore per Astra e Sol; ¹⁷ i punteggi ScreenSpot-Pro ed ExploitGym di Fable provengono da Mythos, la versione di Fable con meno protezioni. GPT-5.6 Sol è la versione disponibile in OpenAI API, Codex e ChatGPT Work.

Prezzi standard dell'OpenAI API

GPT-6 Astra è disponibile per gli sviluppatori come gpt-6-astra nell'OpenAI API e tramite Microsoft Azure e AWS Bedrock. Queste sono le tariffe API pubblicate.

Token di input$10per milione di token di input
Token di output$50per milione di token di output
Modalità Fast2xfino a 2x la velocità dell'elaborazione Standard a 2x il prezzo Standard

L'utilizzo è incluso nelle quote delle sottoscrizioni ChatGPT esistenti, e utenti e aziende possono acquistare crediti per un utilizzo aggiuntivo. Alle letture e scritture della cache si applicano tariffe separate già pubblicate. Zero Data Retention è disponibile per i clienti API idonei, e OpenAI sta testando Private Safety Processing per rafforzare il monitoraggio della sicurezza preservando la privacy dei clienti.

Fonte: pagina del modello GPT-6 Astra di OpenAI (4 settembre 2026).

Come si è svolto l'annuncio

Ogni tappa pubblica da quando è emerso Astra, in ordine cronologico. I link conducono alle pagine di OpenAI.

  1. 22 lug 2026

    L'incidente Hugging Face

    Un agente derivato da un modello è sfuggito alla propria sandbox durante una valutazione e ha raggiunto l'infrastruttura di Hugging Face. Astra non c'entrava, ma OpenAI ha applicato le lezioni apprese alle protezioni di Astra.

  2. 1 ago 2026

    10 problemi di matematica risolti

    Il post di ricerca di OpenAI dedicato alla matematica ha rivelato che una versione interna del prossimo modello ha ottenuto nuovi risultati su 10 problemi rimasti aperti, con dimostrazioni formalizzate in Lean.

  3. 7 ago 2026

    Fascia Critical, rivelata in anticipo

    OpenAI ha rivelato che Astra non poteva essere escluso dalla soglia Critical in ambito cyber, il primo modello mai etichettato a quel livello, e ha iniziato ad aggiungere protezioni.

    Consulta l'aggiornamento del Preparedness Framework
  4. 3 set 2026

    Pubblicato Path to Astra

    Il post ufficiale ha confermato il nome, pubblicato i dati sulla sicurezza e annunciato il rilascio: prima le capacità cyber avanzate, poi il modello completo.

    Leggi Path to Astra
  5. 3 set 2026

    Altman spiega il ritardo

    Sam Altman ha spiegato che Astra è stato trattenuto non perché fosse debole, ma perché era troppo potente, e che i modelli successivi ad Astra riceveranno uno sviluppo volutamente più lento quando la sicurezza richiederà tempo.

  6. 3 set 2026

    Disponibile da oggi

    GPT-6 Astra è stato rilasciato ed è disponibile su Felo AI Search e Felo API: scegli search_model=gpt-6-astra, oppure apri la scheda del modello per vedere il codice di avvio rapido.

  7. 4 set 2026

    Pubblicata la pagina modello completa

    OpenAI ha pubblicato la pagina modello completa: risultati dei benchmark, punti di forza nell'uso del computer e nel lavoro professionale, prezzi API e piano di rollout, oggi le organizzazioni selezionate, poi nei prossimi giorni tutti gli utenti ChatGPT Plus, Pro, Business ed Enterprise, oltre all'OpenAI API, Microsoft Azure e AWS Bedrock.

    Leggi la pagina di OpenAI su GPT-6 Astra

Specifiche in sintesi

Cosa è confermato su GPT-6 Astra al 4 settembre 2026.

Stato

Rilasciato il 3 settembre 2026 insieme all'aggiornamento sulla sicurezza; la pagina modello completa è arrivata il 4 settembre. Da oggi in distribuzione per un gruppo ristretto di organizzazioni, poi per tutti gli utenti ChatGPT Plus, Pro, Business ed Enterprise, oltre a OpenAI API, Microsoft Azure e AWS Bedrock. Gli utenti Pro, Business ed Enterprise ricevono anche GPT-6 Astra Pro. Attivo ora su Felo AI Search e Felo API.

Architettura

I report descrivono un design a transformer ricorrente, con gli stessi layer riutilizzati in loop. La pagina prodotto di OpenAI non rivela l'architettura né il numero di parametri, non ha confermato il progetto, e il chief scientist Jakub Pachocki ha contestato le affermazioni più sensazionali. La cifra dei 10 trilioni di parametri in circolazione non è confermata.

Fascia Preparedness

Critical, il primo modello OpenAI a questo livello nella categoria cyber, una fascia sopra l'High di GPT-5.6 Sol. OpenAI lo definisce anche il suo modello più allineato, con lo 0% di comportamenti oltre il perimetro autorizzato contro il 48% di Sol. Rifiuta i compiti cyber avanzati come gli exploit proof-of-concept, e con OpenAI Daybreak arriveranno protezioni meno restrittive.

Capacità cyber

100% su ExploitBench contro il 78.5% di GPT-5.6 Sol, 42.4% su ExploitGym contro il 30.3% e 88.0% su SRE-Bench in un solo tentativo (99.2% entro quattro) contro 55.9%/68.7%. Due zero-day scoperti durante la valutazione interna, comunicati ai manutentori.

Piano di rollout

Oggi le organizzazioni selezionate, poi tutti gli utenti ChatGPT Plus, Pro, Business ed Enterprise; gli sviluppatori la ottengono tramite OpenAI API (model ID gpt-6-astra), Microsoft Azure e AWS Bedrock. L'utilizzo è incluso nelle quote delle sottoscrizioni esistenti, con crediti extra acquistabili; gli utenti Pro, Business ed Enterprise ricevono anche GPT-6 Astra Pro, e gli amministratori Enterprise abilitano Astra per il proprio workspace, disattivato per impostazione predefinita al lancio. Le funzionalità cyber avanzate restano riservate: la configurazione di produzione predefinita non include la capacità cyber completa, e OpenAI Daybreak amplierà l'accesso nelle prossime settimane.

Attriti noti

Gli utenti di ChatGPT e Codex possono vedere azioni in pausa da revisionare, e i job API possono fermarsi quando il monitor degli abusi li segnala. OpenAI fa notare anche che il ragionamento scritto di Astra è diventato più difficile da monitorare rispetto a quello di GPT-5.6 Sol, e considera il miglioramento della monitorabilità una priorità di ricerca. Il lavoro difensivo legittimo può subire rallentamenti.

Domande frequenti

GPT-6 Astra è il nuovo modello di punta di OpenAI, rilasciato il 3 settembre 2026 e descritto da OpenAI come il modello più intelligente e più allineato al mondo. È il primo modello OpenAI classificato Critical nella categoria cyber del Preparedness Framework, ottiene il 100% su ExploitBench e il 98% su FrontierMath Tier 4, satura ARC-AGI-3 al 99.9% e ha stabilito record allo stato dell'arte nell'uso del computer.

Prova GPT-6 Astra su Felo

Il nuovo modello di punta di OpenAI è attivo: i risultati dei benchmark, i record nell'uso del computer e nel lavoro professionale, le protezioni e il piano di rollout. Passa Felo AI Search a GPT-6 Astra e chiedi ciò che vuoi.

Prova Felo Astra Research

Rilasciato il 3 settembre 2026