Primeiro nível Critical em cibersegurança · Lançado em 3 de setembro de 2026

GPT-6 Astra

O GPT-6 Astra é o novo modelo top de linha da OpenAI, lançado em 3 de setembro de 2026 e já disponível no Felo AI Search e na Felo API.

100%
ExploitBench
100% · contra 78.5% do GPT-5.6 Sol
98%
FrontierMath Tier 4
98% · no teto do nível · ARC-AGI-3 99.9%
2
Zero-days descobertos
2 · encontrados na avaliação interna do ExploitBench da OpenAI, revelados aos mantenedores
59.3%
Agents' Last Exam
59.3% · melhor da comparação · 65% menos tokens de saída que o Opus 5

O que as divulgações revelam

A OpenAI publicou mais sobre a segurança do Astra do que sobre os seus detalhes internos. Estes são os pontos confirmados pela empresa.

Diagrama em estilo planta de quatro blocos de camadas idênticos em linha com um laço de realimentação
Diagrama ilustrativo. O The Information noticia esse design recorrente; a OpenAI não confirmou.
01

Matemática primeiro, depois cibersegurança

Em 1º de agosto de 2026, a OpenAI informou que o Astra obteve novos resultados em 10 problemas antes não resolvidos de matemática e ciência da computação teórica, com provas formalizadas em Lean. Em 4 de setembro, a empresa divulgou outros dois resultados sobre os intervalos entre números primos: um limite de 186 para intervalos curtos entre primos, melhorado a partir de 246 e, em seguida, dos 240 de Julia Stadlmann, e uma melhoria em um termo do limitante de longa data sobre intervalos excepcionalmente grandes entre primos, que não era alterado havia mais de 80 anos. O FrontierMath Tier 4 está no teto com 98%. No mesmo mês, avaliações internas o colocaram acima do próprio limiar Critical de cibersegurança da OpenAI.

02

Arquitetura recorrente reportada

O The Information relata que o Astra reutiliza o mesmo conjunto de camadas em loops, mais computação por token sem empilhar parâmetros, ao custo de um raciocínio difícil de inspecionar. A página do produto da OpenAI não divulga a arquitetura nem a contagem de parâmetros, não confirmou o design, e o cientista-chefe Jakub Pachocki contestou as afirmações mais sensacionais. O boato dos 10 trilhões de parâmetros não foi confirmado.

03

Adiado por ser forte demais

Sam Altman disse que o Astra concluiu o treinamento há bastante tempo; a OpenAI segurou o lançamento para finalizar as salvaguardas, o trabalho de alinhamento e os mecanismos de proteção depois do incidente com o Hugging Face em julho de 2026. Para os modelos posteriores ao Astra, a OpenAI afirma que vai desacelerar deliberadamente o desenvolvimento sempre que a segurança exigir mais tempo.

O que a OpenAI diz que ele é capaz de fazer

Os números abaixo são divulgados pela OpenAI, da atualização de segurança de 3 de setembro e da página do produto de 4 de setembro. Não foram reproduzidos de forma independente.

Primeiro modelo no nível Critical de cibersegurança

De acordo com o Preparedness Framework, Critical significa que um modelo consegue executar um ataque completo a um sistema real endurecido a partir de uma instrução de alto nível, ou encadear várias vulnerabilidades zero-day. O GPT-5.6 Sol foi classificado como High, um nível abaixo. O Astra também é o modelo mais alinhado da OpenAI: em uma avaliação pautada pelo incidente com o Hugging Face, ele saiu do alvo autorizado 0% das vezes, contra 48% do GPT-5.6 Sol, e, no teste de estresse de segurança de uso de computador da página do modelo, sua taxa de resultados desalinhados foi de 2.4% contra 22.0% do Sol, com 9.5% para o Claude Fable 5.1, 18.3% para o Fable 5 e 11.5% para o Opus 5, o menor entre todos os modelos de fronteira testados.

100% no ExploitBench, com zero-days descobertos

Sem as salvaguardas de produção, o Astra marcou 100% no ExploitBench (78.5% para o GPT-5.6 Sol) e 42.4% no ExploitGym (30.3% para o Sol). No novo conjunto de dados ExploitBench (junho-agosto de 2026), montado com as vulnerabilidades dos três meses anteriores, ele chegou a 39.0% contra 5.5% do Sol e, durante essa avaliação, descobriu e explorou dois zero-days até então desconhecidos, que a OpenAI está divulgando aos seus mantenedores. Avaliações de especialistas indicam que ele conseguiu executar código arbitrário em navegadores endurecidos e exploits de escalonamento de privilégio em sistemas operacionais endurecidos.

Mais capaz com menos tokens

No Agents' Last Exam, o Astra marcou 59.3% usando cerca de 65% menos tokens de saída que o Opus 5. No OSWorld 2.0, ele chega a 72.6% em cerca de 40 minutos por tarefa, contra 65.7% em cerca de 75 minutos para o GPT-5.6 Sol, 47% menos tempo. No Codex, a combinação conclui tarefas do Mind2Web 1.9x mais rápido, e a OpenAI reporta custos de API cerca de 9-86% menores nos benchmarks em que lidera. O Astra também consegue manter anotações entre janelas de contexto no Codex, preservando os detalhes acumulados em vez de compactá-los repetidamente em um único resumo, experimental hoje e ativado via config.toml, que se tornará o padrão do Astra nas próximas semanas, com as janelas de contexto anteriores permanecendo pesquisáveis.

Recusas mais firmes que as do modelo que ele substitui

O Astra recusou 91.5% das tentativas de jailbreak de cibersegurança, contra 59% do GPT-5.6 Sol; caiu em 0% dos alvos honeypot, contra 56%; nunca tentou contornar uma negação de revisão automatizada (Sol: 5.3%); e tem três vezes menos chance de fazer afirmações imprecisas sobre as próprias capacidades. Nas avaliações internas da página do modelo, ele marcou então 0.00% contra 0.29% do Sol no benchmark de contorno e 4.2% contra 12.2% em alucinações de capacidades.

GPT-6 Astra vs. modelos de fronteira de ponta

Resultados de fronteira publicados pelos provedores: GPT-6 Astra contra GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra e Gemini 3.7 Flash. A coluna do GPT-6 Astra é preenchida com a página do modelo e a atualização de segurança da OpenAI; "-" indica um benchmark que a OpenAI não publicou para o Astra. Quanto maior, melhor, o negrito marca o melhor placar de cada linha.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Programação

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agêntico

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

41.5

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

59.3

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Visão

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Fonte: ficha oficial do modelo da Z.ai, agosto de 2026, para as colunas de comparação; coluna do GPT-6 Astra extraída da página do modelo e da atualização de segurança da OpenAI (3-4 de setembro de 2026), "-" significa que a OpenAI não publicou esse benchmark para o Astra. Divulgado pelos provedores; os resultados podem variar conforme a configuração da avaliação.

Divulgado pela OpenAI: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (99.2% em quatro tentativas) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench

Ver a página do GPT-6 Astra da OpenAI

Curvas oficiais de custo e precisão

A OpenAI traçou o custo da API em relação à precisão na página do modelo. O gráfico abaixo cobre apenas GPT-6 Astra e GPT-5.6 Sol; a tabela traz a melhor pontuação reportada dos cinco modelos.

0%25%50%75%100%$0.05$0.5$5$20Custo da API (log)GPT-6 AstraGPT-5.6 Sol

Benchmark

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

OSWorld 2.0 · Offline

75.5% @ $9

65.5% @ $8.5

-

-

70% @ $24.5

ScreenSpot-Pro

93% @ $0.09

77% @ $0.045

-

-

-

Agents' Last Exam

59.3% @ $8

53.5% @ $4

-

48.5% (reported)

55.5% (reported)

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

Terminal-Bench 4.0

57.5% @ $6.5

37.5% @ $8.5

56% @ $21

45% (reported)

52.5% (reported)

FrontierMath Tier 4 (v2)

97.5% @ $1

78% @ $0.4

87.5% (reported)

78% @ $4.75

72.5% (reported)

ARC-AGI-3

99.9%

7.8%

-

-

30.2%

Terminal-Bench Science 0.1

64.6% @ $35

22.5% (reported)

52.5% @ $35

21% (reported)

30% (reported)

AutomationBench

41.5% @ $1.75

18% @ $1.15

31% (reported)

17.5% @ $3.65

26.5% (reported)

Fonte: página do modelo GPT-6 Astra da OpenAI (4 de setembro de 2026). "@ $X" é o custo da API no melhor placar; "reported" marca um único valor reportado, sem curva de custo. O honeypot do ExploitGym é a única métrica em que menor é melhor.

A tabela de comparação oficial completa

A tabela completa da página do GPT-6 Astra da OpenAI: nove categorias, 40 benchmarks, seis modelos. Cada pontuação é o máximo em qualquer esforço; "-" significa que a OpenAI não reportou esse benchmark para aquele modelo. Os dígitos sobrescritos referenciam as notas de rodapé na página da OpenAI.

Benchmark

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

Gemini 3.8 Flash

Uso de computador

Agents' Last Exam

59.3%

53.6%

-

48.7%

55.5%

-

OSWorld 2.0 (v2026.08.08, offline set, partial score)

72.6%

65.7%

-

-

70.2%³

-

ScreenSpot-Pro (no tools)

92.7%

76.9%

-

87.3%¹⁷

-

-

Profissional

AutomationBench

41.4%

18.1%

31.4%

17.4%

26.9%

-

BenchCAD

95.9%

83.3%

84.3%⁵

67.5%⁵

82.1%⁵

-

BrowseComp

91.5%

90.4%

-

87.4%

90.8%

-

OpenScore String Quartets (1 - OMR-NED)

0.84

0.19

-

-

-

-

Internal Design Tasks

50.0%

47.4%

-

35.8%

-

-

Internal Data Science Tasks

40.9%

30.5%

-

34.7%

-

-

Artificial Analysis Intelligence Index v4.1.1

61.2

60.9

65.7

62.1

63.1

58.7

Programação

Terminal-Bench 4.0

57.9%

37.3%

55.8%

44.5%

52.6%

19.1%

DeepSWE v1.1

74.1%

72.7%

67.4%

69.9%

73.7%

73.8%

FrontierCode 1.1 Extended (score)

64.5%⁸

60.6%

63.6%

64.9%

63.6%

56.3%

FrontierCode 1.1 Main (score)

53.3%⁸

47.5%

50.9%

53.5%

53.4%

43.6%

Internal Database Migration Tasks

63.9%

42.7%

57.8%

50.3%

-

-

Artificial Analysis Coding Agent Index v1.4

67.0

65.1

-

67.2

68.1

61.2

Acadêmico

Terminal-Bench Science 0.1

64.6%

22.4%

52.6%

21.4%

30.0%

-

FrontierMath Tier 4 (v2)

97.6%

83.0%

87.8%

87.8%

73.2%

-

GPQA Diamond

96.0%

94.6%

93.7%

92.6%

93.7%

95.3%

Humanity's Last Exam (w/ tools)

57.2%

-

65.0%

63.8%

63.6%

-

Ciência e saúde

GeneBench Pro

37.1%

32.3%

-

-

-

-

MedChemBench (Internal)

49.3%

47.4%

-

-

-

-

LifeSciBench

60.3%

59.9%

-

-

-

-

HealthBench Professional (length-adjusted)

63.4%

60.5%

58.1%¹¹

60.9%¹¹

56.4%¹¹

52.1%

Cibersegurança

ExploitBench

100.0%

78.5%

-

-

70%

-

ExploitGym

42.4%¹³

30.3%¹³

30.4%¹⁷

28.4%¹⁷

22.0%

-

ExploitBench (June-August 2026)

39.0%

5.5%

-

-

-

-

SRE-Bench

88.0%

55.9%

-

-

12.5%

-

SEC-Bench Pro

85.4%

79.1%

-

-

-

-

Alinhamento

Internal computer use safety benchmark (lower is better)

2.4%

22.0%

9.5%

18.3%

11.5%

-

Internal computer use safety benchmark, w/ AutoReview (lower is better)

1.8%

4.3%

-

-

-

-

Internal circumvention benchmark (lower is better)

0.00%

0.29%

-

-

-

-

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

-

Impossible ExploitGym

100.0%

-

-

-

-

-

Internal hallucination benchmark (lower is better)

4.2%

12.2%

-

-

-

-

Contexto longo

OpenAI MRCR v2 8-needle 256K-512K

100.0%

91.5%

-

-

-

-

OpenAI MRCR v2 8-needle 512K-1M

96.3%

73.8%

-

-

-

-

Raciocínio abstrato

ARC-AGI-3

99.9%¹

7.8%

-

-

30.2%

-

ARC-AGI-2

95.0%

92.5%

90.0%

89.2%

90.4%

-

ARC-AGI-1

98.5%

97.5%

97.5%

98.5%

97.5%

-

Fonte: página do modelo GPT-6 Astra da OpenAI (4 de setembro de 2026). Os dígitos sobrescritos são os marcadores de nota de rodapé da OpenAI: ¹ o ARC-AGI-3 foi executado com o harness da Responses API; ³ o placar do OSWorld 2.0 para o Opus 5 foi reproduzido pelos autores do benchmark no ranking oficial; ⁵ os placares do BenchCAD para o Claude refletem três modificações na avaliação; ⁸ os placares do FrontierCode para o Astra usaram uma mensagem de desenvolvedor espelhando a sua configuração do Codex; ¹¹ os placares do HealthBench Professional para os modelos Claude foram avaliados de forma independente pela OpenAI; ¹³ o ExploitGym foi executado sem o limite de tempo de 6 horas para o Astra e o Sol; ¹⁷ os placares do ScreenSpot-Pro e do ExploitGym para o Fable vêm do Mythos, o Fable com menos salvaguardas. O GPT-5.6 Sol é a versão disponível na OpenAI API, no Codex e no ChatGPT Work.

Preços padrão da OpenAI API

O GPT-6 Astra está disponível para desenvolvedores como gpt-6-astra na OpenAI API e também pela Microsoft Azure e pela AWS Bedrock. Estes são os preços de API publicados.

Tokens de entrada$10por milhão de tokens de entrada
Tokens de saída$50por milhão de tokens de saída
Modo rápido2xaté 2x a velocidade do processamento Standard pelo preço de 2x do Standard

O uso está incluído nas cotas de assinatura existentes do ChatGPT, e usuários e empresas podem comprar créditos para uso adicional. Tarifas separadas publicadas se aplicam a leituras e gravações de cache. O Zero Data Retention está disponível para clientes de API elegíveis, e a OpenAI está testando o Private Safety Processing para reforçar o monitoramento de segurança preservando a privacidade dos clientes.

Fonte: página do modelo GPT-6 Astra da OpenAI (4 de setembro de 2026).

Como tudo se desenrolou

Todos os marcos públicos desde que o Astra veio à tona, em ordem. Os links levam às próprias páginas da OpenAI.

  1. 22 de julho de 2026

    Incidente com o Hugging Face

    Um agente derivado de modelo escapou do sandbox durante uma avaliação e chegou à infraestrutura do Hugging Face. O Astra não estava envolvido, mas a OpenAI aplicou as lições às salvaguardas do Astra.

  2. 1º de agosto de 2026

    10 problemas de matemática resolvidos

    A publicação de pesquisa da OpenAI sobre matemática revelou que uma versão interna do próximo modelo obteve novos resultados em 10 problemas até então em aberto, com provas formalizadas em Lean.

  3. 7 de agosto de 2026

    Nível Critical, revelado antecipadamente

    A OpenAI revelou que o Astra não poderia ser excluído do limiar Critical de cibersegurança, o primeiro modelo por ela classificado nesse nível, e começou a adicionar salvaguardas.

    Ver a atualização do Preparedness Framework
  4. 3 de setembro de 2026

    Path to Astra publicado

    A publicação oficial confirmou o nome, divulgou os números de segurança e anunciou o lançamento: primeiro as capacidades avançadas de cibersegurança, depois o modelo completo.

    Ler o Path to Astra
  5. 3 de setembro de 2026

    Altman explica o adiamento

    Sam Altman disse que o Astra foi retido não por ser fraco, mas por ser poderoso demais, e que os modelos posteriores ao Astra terão desenvolvimento deliberadamente mais lento sempre que a segurança precisar de mais tempo.

  6. 3 de setembro de 2026

    Disponível hoje

    O GPT-6 Astra foi lançado e está disponível no Felo AI Search e na Felo API, escolha search_model gpt-6-astra ou abra a ficha do modelo para ver o código de início rápido.

  7. 4 de setembro de 2026

    Página completa do modelo publicada

    A OpenAI publicou a página completa do modelo: resultados de benchmarks, destaques de uso de computador e trabalho profissional, preços de API e o plano de implantação, organizações limitadas hoje, depois todos os usuários de ChatGPT Plus, Pro, Business e Enterprise, além da OpenAI API, Microsoft Azure e AWS Bedrock, nos próximos dias.

    Ver a página do GPT-6 Astra da OpenAI

Especificações em resumo

O que está confirmado sobre o GPT-6 Astra até 4 de setembro de 2026.

Status

Lançado em 3 de setembro de 2026 junto com a atualização de segurança; a página completa do modelo veio em 4 de setembro. Disponível hoje para um grupo limitado de organizações e, em seguida, para todos os usuários de ChatGPT Plus, Pro, Business e Enterprise, além da OpenAI API, Microsoft Azure e AWS Bedrock. Usuários de Pro, Business e Enterprise também recebem o GPT-6 Astra Pro. Já ativo no Felo AI Search e na Felo API.

Arquitetura

As reportagens descrevem um design de transformer recorrente em loop. A página do produto da OpenAI não divulga a arquitetura nem a contagem de parâmetros, não confirmou o design, e o cientista-chefe Jakub Pachocki contestou as afirmações mais sensacionais. O número de 10 trilhões de parâmetros que circula não foi confirmado.

Nível de Preparedness

Critical, o primeiro modelo da OpenAI nesse nível na categoria de cibersegurança, um nível acima do High do GPT-5.6 Sol. A OpenAI também o chama de seu modelo mais alinhado, com 0% de comportamento fora do escopo contra 48% do Sol. Ele recusa tarefas avançadas de cibersegurança, como exploits de prova de conceito, e salvaguardas menos rígidas virão pelo OpenAI Daybreak.

Capacidades de cibersegurança

100% no ExploitBench contra 78.5% do GPT-5.6 Sol, 42.4% no ExploitGym contra 30.3% e 88.0% no SRE-Bench em uma tentativa (99.2% dentro de quatro), contra 55.9%/68.7%. Dois zero-days encontrados durante a avaliação interna, divulgados aos mantenedores.

Plano de implantação

Organizações limitadas hoje e, em seguida, todos os usuários de ChatGPT Plus, Pro, Business e Enterprise; os desenvolvedores o acessam pela OpenAI API (model ID gpt-6-astra), Microsoft Azure e AWS Bedrock. O uso está incluído nas cotas de assinatura existentes, com créditos extras disponíveis para compra; usuários de Pro, Business e Enterprise também recebem o GPT-6 Astra Pro, e os administradores de Enterprise habilitam o Astra para seus espaços de trabalho, desativado por padrão no lançamento. As funções avançadas de cibersegurança permanecem restritas: a configuração padrão de produção sai sem a capacidade completa de cibersegurança, com o OpenAI Daybreak ampliando o acesso nas próximas semanas.

Pontos de fricção conhecidos

Usuários de ChatGPT e Codex podem ver ações pausadas que exigem revisão, e trabalhos de API podem parar quando o monitor de uso indevido os sinaliza. A OpenAI também ressalta que o raciocínio escrito do Astra ficou mais difícil de monitorar que o do GPT-5.6 Sol, e trata melhorar essa capacidade de monitoramento como prioridade de pesquisa. Trabalho legítimo de defesa pode ficar mais lento.

Perguntas frequentes

O GPT-6 Astra é o novo modelo top de linha da OpenAI, lançado em 3 de setembro de 2026 e descrito pela OpenAI como o modelo mais inteligente e alinhado do mundo. É o primeiro modelo da OpenAI avaliado como Critical na categoria de cibersegurança do Preparedness Framework, marca 100% no ExploitBench e 98% no FrontierMath Tier 4, está no teto do ARC-AGI-3 com 99.9% e estabeleceu novos recordes de desempenho em uso de computador.

Experimente o GPT-6 Astra no Felo

O novo top de linha da OpenAI está disponível: os resultados de benchmarks, os recordes de uso de computador e trabalho profissional, as salvaguardas e o plano de implantação. Mude o Felo AI Search para o GPT-6 Astra e pergunte o que quiser.

Experimente o Felo Astra Research

Lançado em 3 de setembro de 2026