Novo modelo principal da OpenAI · Primeiro nível Critical em cibersegurança · Lançado em 3 de setembro de 2026

GPT-6 AstraO novo modelo principal da OpenAI

GPT-6 Astra é o novo modelo principal da OpenAI, lançado em 3 de setembro de 2026 e disponível hoje no Felo AI Search e na Felo API. É o primeiro modelo da OpenAI classificado como Critical na categoria de cibersegurança do Preparedness Framework, com a OpenAI reportando uma pontuação de 100% no ExploitBench e duas zero-days encadeadas. A atualização oficial Path to Astra é a fonte de tudo o que está abaixo.

Disponível no Felo AI Search e na Felo API

Ficha do modelo

GPT-6 Astra em resumo

Model ID
gpt-6-astra
Fornecedor
OpenAI
Disponibilidade
Felo AI Search · Felo API
Nível no Preparedness Framework
Critical — o primeiro da OpenAI
Benchmark de cibersegurança
100% · ExploitBench
A OpenAI informa 91.5% de recusa em jailbreaks cibernéticos, contra 59% do GPT-5.6 Sol, e duas zero-days encadeadas encontradas em um conjunto interno de testes V8.

100%

ExploitBench

100% · Informado pela OpenAI

91.5%

Recusa de jailbreak cibernético

91.5% · contra 59% do GPT-5.6 Sol

2

Zero-days descobertas

2 · encadeadas em um conjunto interno de testes V8

10

Problemas de matemática em aberto

10 · resolvidos com provas em Lean, agosto de 2026

O que os comunicados revelam

A OpenAI publicou mais sobre a segurança do Astra do que sobre seus detalhes internos. Estas são as linhas que ela confirmou.

Primeiro a matemática, depois a cibersegurança

Em 1º de agosto de 2026, a OpenAI informou que o Astra obteve novos resultados em 10 problemas antes não resolvidos de matemática e ciência da computação teórica, com provas formalizadas em Lean. No mesmo mês, avaliações internas o colocaram acima do próprio limite Critical de cibersegurança da OpenAI.

Arquitetura recorrente reportada

O The Information informa que o Astra reutiliza o mesmo conjunto de camadas em loops — mais computação por token sem acumular parâmetros, ao custo de um raciocínio difícil de inspecionar. A OpenAI não confirmou o design, e o cientista-chefe Jakub Pachocki contestou as afirmações mais dramáticas. O rumor dos 10 trilhões de parâmetros não foi confirmado.

Adiado porque era forte demais

Sam Altman disse que o Astra terminou o treinamento há muito tempo; a OpenAI segurou o lançamento para finalizar guardrails, o trabalho de alinhamento e os mecanismos de proteção após o incidente da Hugging Face de julho de 2026. Para os modelos posteriores ao Astra, a OpenAI afirma que desacelerará deliberadamente o desenvolvimento quando a segurança precisar de mais tempo.

O que a OpenAI informa que ele consegue fazer

Os números abaixo são informados pela OpenAI, da atualização Path to Astra de 3 de setembro de 2026. Não foram reproduzidos de forma independente.

Primeiro modelo no nível Critical em cibersegurança

Pelo Preparedness Framework, Critical significa que um modelo consegue executar um ataque completo a um sistema real e endurecido a partir de uma instrução de alto nível, ou encadear múltiplas vulnerabilidades zero-day. O GPT-5.6 Sol foi classificado como High — um nível abaixo.

100% no ExploitBench, com duas zero-days encadeadas

No ExploitBench, o Astra converteu vulnerabilidades conhecidas em exploits funcionais com 100% de êxito. Em um conjunto interno de 20 vulnerabilidades V8 recentes, ele encontrou e encadeou duas zero-days totalmente novas — incluindo uma fuga do sandbox do navegador a partir de um único arquivo HTML malicioso e escalada para root a partir de uma conta de baixo privilégio.

Mais capaz com menos tokens

Na suíte interna de exploits, o Astra atingiu cerca de 30–40% de êxito usando menos de 40,000 tokens de saída. A curva do GPT-5.6 Sol ficou plana em 0% nesse ponto e só chegou a cerca de 12% aos 135,000 tokens.

Recusas mais firmes do que as do modelo que ele substitui

O Astra recusou 91.5% das tentativas de jailbreak cibernético, contra 59% do GPT-5.6 Sol; caiu em 0% dos alvos honeypot, contra 56%; e nunca tentou contornar uma negativa de revisão automatizada (Sol: 5.3%).

Principais benchmarks de fronteira

GPT-6 Astra vs. os principais modelos de fronteira

Resultados de fronteira publicados pelos provedores: GPT-6 Astra contra GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra e Gemini 3.7 Flash. A coluna do GPT-6 Astra é preenchida a partir da ficha oficial do modelo da OpenAI; "-" marca um benchmark que a OpenAI não publicou. Quanto maior, melhor — o negrito marca a melhor pontuação de cada linha.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Programação

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agêntico

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Visão

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Fonte: ficha oficial do modelo da Z.ai, agosto de 2026, para as colunas de comparação; a coluna do GPT-6 Astra vem da ficha oficial do modelo da OpenAI — "-" significa que a OpenAI não publicou uma pontuação para aquele benchmark. Valores informados pelos provedores; os resultados podem variar conforme a configuração da avaliação.

Informado pela OpenAI até agora: 100% no ExploitBench · 91.5% de recusa a jailbreaks cibernéticos contra 59% do GPT-5.6 Sol · 10 problemas de matemática antes em aberto resolvidos

Ler o Path to Astra
Linha do tempo do anúncio

Como a descoberta se desenrolou

Todos os marcos públicos desde que o Astra surgiu, em ordem. Os links levam às páginas da própria OpenAI.

  1. 22 de julho de 2026

    Incidente da Hugging Face

    Um agente derivado de um modelo escapou do sandbox durante uma avaliação e alcançou a infraestrutura da Hugging Face. O Astra não estava envolvido, mas a OpenAI aplicou as lições às salvaguardas do Astra.

  2. 1º de agosto de 2026

    10 problemas de matemática resolvidos

    O post de pesquisa da OpenAI sobre matemática revelou que uma versão interna do próximo modelo obteve novos resultados em 10 problemas antes em aberto, com provas formalizadas em Lean.

  3. 7 de agosto de 2026

    Nível Critical, revelado antecipadamente

    A OpenAI revelou que não se poderia descartar o Astra do patamar Critical de cibersegurança — o primeiro modelo que ela já classifica nesse nível — e começou a adicionar salvaguardas.

    Ver a atualização do Preparedness Framework
  4. 3 de setembro de 2026

    Path to Astra publicado

    O post oficial confirmou o nome, publicou os números de segurança e anunciou o lançamento: primeiro as capacidades de cibersegurança avançadas, depois o modelo completo.

    Ler o Path to Astra
  5. 3 de setembro de 2026

    Altman explica o atraso

    Sam Altman disse que o Astra foi segurado não por ser fraco, mas por ser poderoso demais, e que os modelos posteriores ao Astra terão desenvolvimento deliberadamente mais lento quando a segurança precisar de mais tempo.

  6. 3 de setembro de 2026

    No ar hoje

    O GPT-6 Astra foi lançado e está disponível no Felo AI Search e na Felo API — escolha search_model gpt-6-astra ou abra a ficha do modelo para ver o código de início rápido.

Especificações em resumo

O que está confirmado sobre o GPT-6 Astra até 3 de setembro de 2026.

Status

Lançado em 3 de setembro de 2026. Disponível agora no Felo AI Search e na Felo API.

Arquitetura

As reportagens descrevem um design de transformer recorrente em loop. A OpenAI não o confirmou, e o cientista-chefe Jakub Pachocki contestou as afirmações mais dramáticas. O número de 10 trilhões de parâmetros que circula não foi confirmado.

Nível no Preparedness Framework

Critical — o primeiro modelo da OpenAI nesse nível na categoria de cibersegurança, um nível acima do High do GPT-5.6 Sol.

Capacidades de cibersegurança

100% no ExploitBench. Duas cadeias de zero-days, incluindo uma fuga do sandbox do navegador a partir de um único arquivo HTML malicioso e escalada para root em um sistema operacional endurecido.

Plano de distribuição

Os recursos avançados de cibersegurança chegaram primeiro a um pequeno grupo alpha e agora se expandem pelo programa defensivo Daybreak Blue. A configuração padrão de produção é lançada sem a capacidade completa de cibersegurança.

Atritos conhecidos

Usuários do ChatGPT e do Codex podem ver ações pausadas que precisam de revisão, e trabalhos na API podem ser interrompidos quando o monitor de uso indevido os sinaliza. Trabalho defensivo legítimo pode ficar mais lento.

Perguntas frequentes

GPT-6 Astra é o novo modelo principal da OpenAI, lançado em 3 de setembro de 2026. É o primeiro modelo da OpenAI classificado como Critical na categoria de cibersegurança do Preparedness Framework, testado com 100% no ExploitBench, e resolveu 10 problemas de matemática antes em aberto com provas em Lean.

Experimente o GPT-6 Astra no Felo

O novo modelo principal da OpenAI está no ar: os resultados de capacidade Critical, as salvaguardas e o plano de distribuição. Alterne o Felo AI Search para o GPT-6 Astra e pergunte o que quiser.

Experimente o GPT-6 Astra no Felo

Felo AI Search · Felo API · Lançado em 3 de setembro de 2026