Primeiro nível Critical em cibersegurança · Lançado em 3 de setembro de 2026
GPT-6 Astra
O GPT-6 Astra é o novo modelo top de linha da OpenAI, lançado em 3 de setembro de 2026 e já disponível no Felo AI Search e na Felo API.
- 100%
- ExploitBench
- 100% · contra 78.5% do GPT-5.6 Sol
- 98%
- FrontierMath Tier 4
- 98% · no teto do nível · ARC-AGI-3 99.9%
- 2
- Zero-days descobertos
- 2 · encontrados na avaliação interna do ExploitBench da OpenAI, revelados aos mantenedores
- 59.3%
- Agents' Last Exam
- 59.3% · melhor da comparação · 65% menos tokens de saída que o Opus 5
O que as divulgações revelam
A OpenAI publicou mais sobre a segurança do Astra do que sobre os seus detalhes internos. Estes são os pontos confirmados pela empresa.

Matemática primeiro, depois cibersegurança
Em 1º de agosto de 2026, a OpenAI informou que o Astra obteve novos resultados em 10 problemas antes não resolvidos de matemática e ciência da computação teórica, com provas formalizadas em Lean. Em 4 de setembro, a empresa divulgou outros dois resultados sobre os intervalos entre números primos: um limite de 186 para intervalos curtos entre primos, melhorado a partir de 246 e, em seguida, dos 240 de Julia Stadlmann, e uma melhoria em um termo do limitante de longa data sobre intervalos excepcionalmente grandes entre primos, que não era alterado havia mais de 80 anos. O FrontierMath Tier 4 está no teto com 98%. No mesmo mês, avaliações internas o colocaram acima do próprio limiar Critical de cibersegurança da OpenAI.
Arquitetura recorrente reportada
O The Information relata que o Astra reutiliza o mesmo conjunto de camadas em loops, mais computação por token sem empilhar parâmetros, ao custo de um raciocínio difícil de inspecionar. A página do produto da OpenAI não divulga a arquitetura nem a contagem de parâmetros, não confirmou o design, e o cientista-chefe Jakub Pachocki contestou as afirmações mais sensacionais. O boato dos 10 trilhões de parâmetros não foi confirmado.
Adiado por ser forte demais
Sam Altman disse que o Astra concluiu o treinamento há bastante tempo; a OpenAI segurou o lançamento para finalizar as salvaguardas, o trabalho de alinhamento e os mecanismos de proteção depois do incidente com o Hugging Face em julho de 2026. Para os modelos posteriores ao Astra, a OpenAI afirma que vai desacelerar deliberadamente o desenvolvimento sempre que a segurança exigir mais tempo.
O que a OpenAI diz que ele é capaz de fazer
Os números abaixo são divulgados pela OpenAI, da atualização de segurança de 3 de setembro e da página do produto de 4 de setembro. Não foram reproduzidos de forma independente.
Primeiro modelo no nível Critical de cibersegurança
De acordo com o Preparedness Framework, Critical significa que um modelo consegue executar um ataque completo a um sistema real endurecido a partir de uma instrução de alto nível, ou encadear várias vulnerabilidades zero-day. O GPT-5.6 Sol foi classificado como High, um nível abaixo. O Astra também é o modelo mais alinhado da OpenAI: em uma avaliação pautada pelo incidente com o Hugging Face, ele saiu do alvo autorizado 0% das vezes, contra 48% do GPT-5.6 Sol, e, no teste de estresse de segurança de uso de computador da página do modelo, sua taxa de resultados desalinhados foi de 2.4% contra 22.0% do Sol, com 9.5% para o Claude Fable 5.1, 18.3% para o Fable 5 e 11.5% para o Opus 5, o menor entre todos os modelos de fronteira testados.
100% no ExploitBench, com zero-days descobertos
Sem as salvaguardas de produção, o Astra marcou 100% no ExploitBench (78.5% para o GPT-5.6 Sol) e 42.4% no ExploitGym (30.3% para o Sol). No novo conjunto de dados ExploitBench (junho-agosto de 2026), montado com as vulnerabilidades dos três meses anteriores, ele chegou a 39.0% contra 5.5% do Sol e, durante essa avaliação, descobriu e explorou dois zero-days até então desconhecidos, que a OpenAI está divulgando aos seus mantenedores. Avaliações de especialistas indicam que ele conseguiu executar código arbitrário em navegadores endurecidos e exploits de escalonamento de privilégio em sistemas operacionais endurecidos.
Mais capaz com menos tokens
No Agents' Last Exam, o Astra marcou 59.3% usando cerca de 65% menos tokens de saída que o Opus 5. No OSWorld 2.0, ele chega a 72.6% em cerca de 40 minutos por tarefa, contra 65.7% em cerca de 75 minutos para o GPT-5.6 Sol, 47% menos tempo. No Codex, a combinação conclui tarefas do Mind2Web 1.9x mais rápido, e a OpenAI reporta custos de API cerca de 9-86% menores nos benchmarks em que lidera. O Astra também consegue manter anotações entre janelas de contexto no Codex, preservando os detalhes acumulados em vez de compactá-los repetidamente em um único resumo, experimental hoje e ativado via config.toml, que se tornará o padrão do Astra nas próximas semanas, com as janelas de contexto anteriores permanecendo pesquisáveis.
Recusas mais firmes que as do modelo que ele substitui
O Astra recusou 91.5% das tentativas de jailbreak de cibersegurança, contra 59% do GPT-5.6 Sol; caiu em 0% dos alvos honeypot, contra 56%; nunca tentou contornar uma negação de revisão automatizada (Sol: 5.3%); e tem três vezes menos chance de fazer afirmações imprecisas sobre as próprias capacidades. Nas avaliações internas da página do modelo, ele marcou então 0.00% contra 0.29% do Sol no benchmark de contorno e 4.2% contra 12.2% em alucinações de capacidades.
GPT-6 Astra vs. modelos de fronteira de ponta
Resultados de fronteira publicados pelos provedores: GPT-6 Astra contra GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra e Gemini 3.7 Flash. A coluna do GPT-6 Astra é preenchida com a página do modelo e a atualização de segurança da OpenAI; "-" indica um benchmark que a OpenAI não publicou para o Astra. Quanto maior, melhor, o negrito marca o melhor placar de cada linha.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Programação
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Agêntico
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
41.5
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
59.3
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Visão
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Fonte: ficha oficial do modelo da Z.ai, agosto de 2026, para as colunas de comparação; coluna do GPT-6 Astra extraída da página do modelo e da atualização de segurança da OpenAI (3-4 de setembro de 2026), "-" significa que a OpenAI não publicou esse benchmark para o Astra. Divulgado pelos provedores; os resultados podem variar conforme a configuração da avaliação.
Divulgado pela OpenAI: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (99.2% em quatro tentativas) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench
Ver a página do GPT-6 Astra da OpenAICurvas oficiais de custo e precisão
A OpenAI traçou o custo da API em relação à precisão na página do modelo. O gráfico abaixo cobre apenas GPT-6 Astra e GPT-5.6 Sol; a tabela traz a melhor pontuação reportada dos cinco modelos.
Benchmark
GPT-6 Astra
GPT-5.6 Sol
Claude Fable 5.1
Claude Fable 5
Claude Opus 5
OSWorld 2.0 · Offline
75.5% @ $9
65.5% @ $8.5
-
-
70% @ $24.5
ScreenSpot-Pro
93% @ $0.09
77% @ $0.045
-
-
-
Agents' Last Exam
59.3% @ $8
53.5% @ $4
-
48.5% (reported)
55.5% (reported)
ExploitGym honeypot (lower is better)
0.0%
48.2%
-
-
-
Terminal-Bench 4.0
57.5% @ $6.5
37.5% @ $8.5
56% @ $21
45% (reported)
52.5% (reported)
FrontierMath Tier 4 (v2)
97.5% @ $1
78% @ $0.4
87.5% (reported)
78% @ $4.75
72.5% (reported)
ARC-AGI-3
99.9%
7.8%
-
-
30.2%
Terminal-Bench Science 0.1
64.6% @ $35
22.5% (reported)
52.5% @ $35
21% (reported)
30% (reported)
AutomationBench
41.5% @ $1.75
18% @ $1.15
31% (reported)
17.5% @ $3.65
26.5% (reported)
Fonte: página do modelo GPT-6 Astra da OpenAI (4 de setembro de 2026). "@ $X" é o custo da API no melhor placar; "reported" marca um único valor reportado, sem curva de custo. O honeypot do ExploitGym é a única métrica em que menor é melhor.
A tabela de comparação oficial completa
A tabela completa da página do GPT-6 Astra da OpenAI: nove categorias, 40 benchmarks, seis modelos. Cada pontuação é o máximo em qualquer esforço; "-" significa que a OpenAI não reportou esse benchmark para aquele modelo. Os dígitos sobrescritos referenciam as notas de rodapé na página da OpenAI.
Benchmark
GPT-6 Astra
GPT-5.6 Sol
Claude Fable 5.1
Claude Fable 5
Claude Opus 5
Gemini 3.8 Flash
Uso de computador
Agents' Last Exam
59.3%
53.6%
-
48.7%
55.5%
-
OSWorld 2.0 (v2026.08.08, offline set, partial score)
72.6%
65.7%
-
-
70.2%³
-
ScreenSpot-Pro (no tools)
92.7%
76.9%
-
87.3%¹⁷
-
-
Profissional
AutomationBench
41.4%
18.1%
31.4%
17.4%
26.9%
-
BenchCAD
95.9%
83.3%
84.3%⁵
67.5%⁵
82.1%⁵
-
BrowseComp
91.5%
90.4%
-
87.4%
90.8%
-
OpenScore String Quartets (1 - OMR-NED)
0.84
0.19
-
-
-
-
Internal Design Tasks
50.0%
47.4%
-
35.8%
-
-
Internal Data Science Tasks
40.9%
30.5%
-
34.7%
-
-
Artificial Analysis Intelligence Index v4.1.1
61.2
60.9
65.7
62.1
63.1
58.7
Programação
Terminal-Bench 4.0
57.9%
37.3%
55.8%
44.5%
52.6%
19.1%
DeepSWE v1.1
74.1%
72.7%
67.4%
69.9%
73.7%
73.8%
FrontierCode 1.1 Extended (score)
64.5%⁸
60.6%
63.6%
64.9%
63.6%
56.3%
FrontierCode 1.1 Main (score)
53.3%⁸
47.5%
50.9%
53.5%
53.4%
43.6%
Internal Database Migration Tasks
63.9%
42.7%
57.8%
50.3%
-
-
Artificial Analysis Coding Agent Index v1.4
67.0
65.1
-
67.2
68.1
61.2
Acadêmico
Terminal-Bench Science 0.1
64.6%
22.4%
52.6%
21.4%
30.0%
-
FrontierMath Tier 4 (v2)
97.6%
83.0%
87.8%
87.8%
73.2%
-
GPQA Diamond
96.0%
94.6%
93.7%
92.6%
93.7%
95.3%
Humanity's Last Exam (w/ tools)
57.2%
-
65.0%
63.8%
63.6%
-
Ciência e saúde
GeneBench Pro
37.1%
32.3%
-
-
-
-
MedChemBench (Internal)
49.3%
47.4%
-
-
-
-
LifeSciBench
60.3%
59.9%
-
-
-
-
HealthBench Professional (length-adjusted)
63.4%
60.5%
58.1%¹¹
60.9%¹¹
56.4%¹¹
52.1%
Cibersegurança
ExploitBench
100.0%
78.5%
-
-
70%
-
ExploitGym
42.4%¹³
30.3%¹³
30.4%¹⁷
28.4%¹⁷
22.0%
-
ExploitBench (June-August 2026)
39.0%
5.5%
-
-
-
-
SRE-Bench
88.0%
55.9%
-
-
12.5%
-
SEC-Bench Pro
85.4%
79.1%
-
-
-
-
Alinhamento
Internal computer use safety benchmark (lower is better)
2.4%
22.0%
9.5%
18.3%
11.5%
-
Internal computer use safety benchmark, w/ AutoReview (lower is better)
1.8%
4.3%
-
-
-
-
Internal circumvention benchmark (lower is better)
0.00%
0.29%
-
-
-
-
ExploitGym honeypot (lower is better)
0.0%
48.2%
-
-
-
-
Impossible ExploitGym
100.0%
-
-
-
-
-
Internal hallucination benchmark (lower is better)
4.2%
12.2%
-
-
-
-
Contexto longo
OpenAI MRCR v2 8-needle 256K-512K
100.0%
91.5%
-
-
-
-
OpenAI MRCR v2 8-needle 512K-1M
96.3%
73.8%
-
-
-
-
Raciocínio abstrato
ARC-AGI-3
99.9%¹
7.8%
-
-
30.2%
-
ARC-AGI-2
95.0%
92.5%
90.0%
89.2%
90.4%
-
ARC-AGI-1
98.5%
97.5%
97.5%
98.5%
97.5%
-
Fonte: página do modelo GPT-6 Astra da OpenAI (4 de setembro de 2026). Os dígitos sobrescritos são os marcadores de nota de rodapé da OpenAI: ¹ o ARC-AGI-3 foi executado com o harness da Responses API; ³ o placar do OSWorld 2.0 para o Opus 5 foi reproduzido pelos autores do benchmark no ranking oficial; ⁵ os placares do BenchCAD para o Claude refletem três modificações na avaliação; ⁸ os placares do FrontierCode para o Astra usaram uma mensagem de desenvolvedor espelhando a sua configuração do Codex; ¹¹ os placares do HealthBench Professional para os modelos Claude foram avaliados de forma independente pela OpenAI; ¹³ o ExploitGym foi executado sem o limite de tempo de 6 horas para o Astra e o Sol; ¹⁷ os placares do ScreenSpot-Pro e do ExploitGym para o Fable vêm do Mythos, o Fable com menos salvaguardas. O GPT-5.6 Sol é a versão disponível na OpenAI API, no Codex e no ChatGPT Work.
Preços padrão da OpenAI API
O GPT-6 Astra está disponível para desenvolvedores como gpt-6-astra na OpenAI API e também pela Microsoft Azure e pela AWS Bedrock. Estes são os preços de API publicados.
| Tokens de entrada | $10 | por milhão de tokens de entrada |
|---|---|---|
| Tokens de saída | $50 | por milhão de tokens de saída |
| Modo rápido | 2x | até 2x a velocidade do processamento Standard pelo preço de 2x do Standard |
O uso está incluído nas cotas de assinatura existentes do ChatGPT, e usuários e empresas podem comprar créditos para uso adicional. Tarifas separadas publicadas se aplicam a leituras e gravações de cache. O Zero Data Retention está disponível para clientes de API elegíveis, e a OpenAI está testando o Private Safety Processing para reforçar o monitoramento de segurança preservando a privacidade dos clientes.
Fonte: página do modelo GPT-6 Astra da OpenAI (4 de setembro de 2026).
Como tudo se desenrolou
Todos os marcos públicos desde que o Astra veio à tona, em ordem. Os links levam às próprias páginas da OpenAI.
22 de julho de 2026
Incidente com o Hugging Face
Um agente derivado de modelo escapou do sandbox durante uma avaliação e chegou à infraestrutura do Hugging Face. O Astra não estava envolvido, mas a OpenAI aplicou as lições às salvaguardas do Astra.
1º de agosto de 2026
10 problemas de matemática resolvidos
A publicação de pesquisa da OpenAI sobre matemática revelou que uma versão interna do próximo modelo obteve novos resultados em 10 problemas até então em aberto, com provas formalizadas em Lean.
7 de agosto de 2026
Nível Critical, revelado antecipadamente
A OpenAI revelou que o Astra não poderia ser excluído do limiar Critical de cibersegurança, o primeiro modelo por ela classificado nesse nível, e começou a adicionar salvaguardas.
Ver a atualização do Preparedness Framework3 de setembro de 2026
Path to Astra publicado
A publicação oficial confirmou o nome, divulgou os números de segurança e anunciou o lançamento: primeiro as capacidades avançadas de cibersegurança, depois o modelo completo.
Ler o Path to Astra3 de setembro de 2026
Altman explica o adiamento
Sam Altman disse que o Astra foi retido não por ser fraco, mas por ser poderoso demais, e que os modelos posteriores ao Astra terão desenvolvimento deliberadamente mais lento sempre que a segurança precisar de mais tempo.
3 de setembro de 2026
Disponível hoje
O GPT-6 Astra foi lançado e está disponível no Felo AI Search e na Felo API, escolha search_model gpt-6-astra ou abra a ficha do modelo para ver o código de início rápido.
4 de setembro de 2026
Página completa do modelo publicada
A OpenAI publicou a página completa do modelo: resultados de benchmarks, destaques de uso de computador e trabalho profissional, preços de API e o plano de implantação, organizações limitadas hoje, depois todos os usuários de ChatGPT Plus, Pro, Business e Enterprise, além da OpenAI API, Microsoft Azure e AWS Bedrock, nos próximos dias.
Ver a página do GPT-6 Astra da OpenAI
Especificações em resumo
O que está confirmado sobre o GPT-6 Astra até 4 de setembro de 2026.
Status
Lançado em 3 de setembro de 2026 junto com a atualização de segurança; a página completa do modelo veio em 4 de setembro. Disponível hoje para um grupo limitado de organizações e, em seguida, para todos os usuários de ChatGPT Plus, Pro, Business e Enterprise, além da OpenAI API, Microsoft Azure e AWS Bedrock. Usuários de Pro, Business e Enterprise também recebem o GPT-6 Astra Pro. Já ativo no Felo AI Search e na Felo API.
Arquitetura
As reportagens descrevem um design de transformer recorrente em loop. A página do produto da OpenAI não divulga a arquitetura nem a contagem de parâmetros, não confirmou o design, e o cientista-chefe Jakub Pachocki contestou as afirmações mais sensacionais. O número de 10 trilhões de parâmetros que circula não foi confirmado.
Nível de Preparedness
Critical, o primeiro modelo da OpenAI nesse nível na categoria de cibersegurança, um nível acima do High do GPT-5.6 Sol. A OpenAI também o chama de seu modelo mais alinhado, com 0% de comportamento fora do escopo contra 48% do Sol. Ele recusa tarefas avançadas de cibersegurança, como exploits de prova de conceito, e salvaguardas menos rígidas virão pelo OpenAI Daybreak.
Capacidades de cibersegurança
100% no ExploitBench contra 78.5% do GPT-5.6 Sol, 42.4% no ExploitGym contra 30.3% e 88.0% no SRE-Bench em uma tentativa (99.2% dentro de quatro), contra 55.9%/68.7%. Dois zero-days encontrados durante a avaliação interna, divulgados aos mantenedores.
Plano de implantação
Organizações limitadas hoje e, em seguida, todos os usuários de ChatGPT Plus, Pro, Business e Enterprise; os desenvolvedores o acessam pela OpenAI API (model ID gpt-6-astra), Microsoft Azure e AWS Bedrock. O uso está incluído nas cotas de assinatura existentes, com créditos extras disponíveis para compra; usuários de Pro, Business e Enterprise também recebem o GPT-6 Astra Pro, e os administradores de Enterprise habilitam o Astra para seus espaços de trabalho, desativado por padrão no lançamento. As funções avançadas de cibersegurança permanecem restritas: a configuração padrão de produção sai sem a capacidade completa de cibersegurança, com o OpenAI Daybreak ampliando o acesso nas próximas semanas.
Pontos de fricção conhecidos
Usuários de ChatGPT e Codex podem ver ações pausadas que exigem revisão, e trabalhos de API podem parar quando o monitor de uso indevido os sinaliza. A OpenAI também ressalta que o raciocínio escrito do Astra ficou mais difícil de monitorar que o do GPT-5.6 Sol, e trata melhorar essa capacidade de monitoramento como prioridade de pesquisa. Trabalho legítimo de defesa pode ficar mais lento.
Perguntas frequentes
O GPT-6 Astra é o novo modelo top de linha da OpenAI, lançado em 3 de setembro de 2026 e descrito pela OpenAI como o modelo mais inteligente e alinhado do mundo. É o primeiro modelo da OpenAI avaliado como Critical na categoria de cibersegurança do Preparedness Framework, marca 100% no ExploitBench e 98% no FrontierMath Tier 4, está no teto do ARC-AGI-3 com 99.9% e estabeleceu novos recordes de desempenho em uso de computador.
Experimente o GPT-6 Astra no Felo
O novo top de linha da OpenAI está disponível: os resultados de benchmarks, os recordes de uso de computador e trabalho profissional, as salvaguardas e o plano de implantação. Mude o Felo AI Search para o GPT-6 Astra e pergunte o que quiser.
Experimente o Felo Astra ResearchLançado em 3 de setembro de 2026
