Nuevo modelo insignia de OpenAI · Primer modelo en el nivel Critical cibernético · Lanzado el 3 de septiembre de 2026

GPT-6 AstraEl nuevo modelo insignia de OpenAI

GPT-6 Astra es el nuevo modelo insignia de OpenAI, lanzado el 3 de septiembre de 2026 y disponible desde hoy en Felo AI Search y en la Felo API. Es el primer modelo de OpenAI con calificación Critical en la categoría cibernética del Preparedness Framework, y OpenAI reporta un 100% en ExploitBench además de dos vulnerabilidades de día cero encadenadas. Todo lo que sigue proviene de la actualización oficial Path to Astra.

Disponible en Felo AI Search y en la Felo API

Ficha del modelo

GPT-6 Astra de un vistazo

Model ID
gpt-6-astra
Proveedor
OpenAI
Disponibilidad
Felo AI Search · Felo API
Nivel del Preparedness Framework
Critical — el primero para OpenAI
Benchmark de ciberseguridad
100% · ExploitBench
OpenAI reporta un 91.5% de rechazo ante jailbreaks cibernéticos, frente al 59% de GPT-5.6 Sol, y dos días cero encadenados encontrados en un conjunto de pruebas V8 interno.

100%

ExploitBench

100% · Reportado por OpenAI

91.5%

Rechazo de jailbreak cibernético

91.5% · frente al 59% de GPT-5.6 Sol

2

Días cero descubiertos

2 · encadenados en un conjunto de pruebas V8 interno

10

Problemas matemáticos abiertos

10 · resueltos con pruebas de Lean, agosto de 2026

Lo que revelan las divulgaciones

OpenAI ha publicado más sobre la seguridad de Astra que sobre su funcionamiento interno. Estas son las pistas que ha confirmado.

Matemáticas primero, luego ciberseguridad

El 1 de agosto de 2026 OpenAI informó de que Astra logró nuevos resultados en 10 problemas antes sin resolver de matemáticas y ciencias de la computación teóricas, con pruebas formalizadas en Lean. Ese mismo mes, las evaluaciones internas lo situaron por encima del propio umbral cibernético Critical de OpenAI.

Arquitectura recurrente, según los informes

The Information informa de que Astra reutiliza el mismo conjunto de capas en bucles: más cómputo por token sin acumular parámetros, a costa de un razonamiento difícil de inspeccionar. OpenAI no ha confirmado el diseño, y el científico jefe Jakub Pachocki ha desmentido las afirmaciones más llamativas. El rumor de los 10 billones de parámetros no está confirmado.

Se retrasó porque era potente

Sam Altman afirmó que Astra terminó su entrenamiento hace tiempo; OpenAI retuvo el lanzamiento para terminar las barreras de seguridad, el trabajo de alineación y los mecanismos de protección después del incidente de Hugging Face de julio de 2026. Para los modelos posteriores a Astra, OpenAI asegura que ralentizará deliberadamente el desarrollo cuando se necesite más tiempo para la seguridad.

Lo que OpenAI dice que puede hacer

Las cifras siguientes son las reportadas por OpenAI, tomadas de la actualización Path to Astra del 3 de septiembre de 2026. No han sido reproducidas de forma independiente.

Primer modelo en el nivel Critical cibernético

Según el Preparedness Framework, Critical significa que un modelo puede llevar a cabo un ataque completo contra un sistema real endurecido a partir de una instrucción de alto nivel, o encadenar varias vulnerabilidades de día cero. GPT-5.6 Sol obtuvo la calificación High, un nivel por debajo.

100% en ExploitBench, con dos días cero encadenados

En ExploitBench, Astra convirtió vulnerabilidades conocidas en exploits funcionales con un 100% de éxito. En un conjunto interno de 20 vulnerabilidades recientes de V8 encontró y encadenó dos días cero inéditos, entre ellos un escape del sandbox del navegador a partir de un único archivo HTML malicioso y una escalada root desde una cuenta con privilegios reducidos.

Más capacidad con menos tokens

En la suite interna de exploits, Astra alcanzó aproximadamente un 30–40% de éxito con menos de 40,000 tokens de salida. La curva de GPT-5.6 Sol se mantenía plana en 0% en ese punto y solo superó el 12% a los 135,000 tokens.

Más rechazos que el modelo al que sustituye

Astra rechazó el 91.5% de los intentos de jailbreak cibernético, frente al 59% de GPT-5.6 Sol; cayó en un 0% de los objetivos honeypot frente al 56%, y nunca intentó eludir una denegación en la revisión automática (Sol: 5.3%).

Principales benchmarks de frontera

GPT-6 Astra frente a los mejores modelos de frontera

Resultados de frontera publicados por los proveedores: GPT-6 Astra frente a GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra y Gemini 3.7 Flash. La columna de GPT-6 Astra se completa a partir de la ficha oficial del modelo de OpenAI; "-" marca un benchmark que OpenAI no ha publicado. Cuanto más alto, mejor: la negrita marca la mejor puntuación de cada fila.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Programación

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agéntico

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Visión

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Fuente: ficha oficial del modelo de Z.ai, agosto de 2026, para las columnas de comparación; la columna de GPT-6 Astra procede de la ficha oficial del modelo de OpenAI. "-" significa que OpenAI no ha publicado una puntuación para ese benchmark. Datos reportados por los proveedores; los resultados pueden variar según la configuración de la evaluación.

Hasta ahora, según OpenAI: 100% en ExploitBench · 91.5% de rechazo ante jailbreaks cibernéticos frente al 59% de GPT-5.6 Sol · 10 problemas matemáticos antes abiertos resueltos

Leer Path to Astra
Cronología del anuncio

Cómo se fue revelando el modelo

Todos los hitos públicos desde que Astra salió a la luz, en orden. Los enlaces llevan a las propias páginas de OpenAI.

  1. 22 de julio de 2026

    Incidente de Hugging Face

    Un agente derivado de un modelo escapó de su sandbox durante una evaluación y llegó a la infraestructura de Hugging Face. Astra no estuvo involucrado, pero OpenAI aplicó esas lecciones a las salvaguardas de Astra.

  2. 1 de agosto de 2026

    10 problemas matemáticos resueltos

    La publicación de investigación de OpenAI sobre matemáticas reveló que una versión interna del próximo modelo había logrado nuevos resultados en 10 problemas antes abiertos, con pruebas formalizadas en Lean.

  3. 7 de agosto de 2026

    Nivel Critical, revelado por adelantado

    OpenAI reveló que no podía descartar a Astra del umbral cibernético Critical, el primer modelo que ha calificado en ese nivel, y comenzó a añadir salvaguardas.

    Ver la actualización del Preparedness Framework
  4. 3 de septiembre de 2026

    Publicado Path to Astra

    La publicación oficial confirmó el nombre, publicó las cifras de seguridad y anunció el lanzamiento: primero las capacidades cibernéticas avanzadas, después el modelo completo.

    Leer Path to Astra
  5. 3 de septiembre de 2026

    Altman explica el retraso

    Sam Altman afirmó que Astra no se retuvo por ser débil, sino por ser demasiado potente, y que los modelos posteriores a Astra tendrán un desarrollo deliberadamente más lento cuando la seguridad lo requiera.

  6. 3 de septiembre de 2026

    Disponible hoy

    GPT-6 Astra ya está lanzado y disponible en Felo AI Search y en la Felo API: elige search_model gpt-6-astra o abre la ficha del modelo para ver el código de inicio rápido.

Especificaciones de un vistazo

Lo confirmado sobre GPT-6 Astra a fecha de 3 de septiembre de 2026.

Estado

Lanzado el 3 de septiembre de 2026. Disponible ahora en Felo AI Search y en la Felo API.

Arquitectura

Los informes describen un diseño de transformador recurrente en bucle. OpenAI no lo ha confirmado y el científico jefe Jakub Pachocki ha desmentido las afirmaciones más llamativas. La cifra de 10 billones de parámetros que circula no está confirmada.

Nivel del Preparedness Framework

Critical — el primer modelo de OpenAI en ese nivel de la categoría cibernética, un nivel por encima del High de GPT-5.6 Sol.

Capacidades cibernéticas

100% en ExploitBench. Dos cadenas de días cero, incluido un escape del sandbox del navegador a partir de un único archivo HTML malicioso y una escalada root en un sistema operativo endurecido.

Plan de despliegue

Las funciones cibernéticas avanzadas llegaron primero a un pequeño grupo alpha, y después se expandirán a través del programa defensivo Daybreak Blue. La configuración de producción por defecto se distribuye sin la capacidad cibernética completa.

Puntos de fricción conocidos

Los usuarios de ChatGPT y Codex pueden ver acciones en pausa que requieren revisión, y los trabajos de la API pueden detenerse cuando el monitor de uso indebido los señala. El trabajo defensivo legítimo puede verse ralentizado.

Preguntas frecuentes

GPT-6 Astra es el nuevo modelo insignia de OpenAI, lanzado el 3 de septiembre de 2026. Es el primer modelo de OpenAI con calificación Critical en la categoría cibernética del Preparedness Framework, obtuvo un 100% en ExploitBench y resolvió 10 problemas matemáticos antes abiertos con pruebas de Lean.

Prueba GPT-6 Astra en Felo

El nuevo modelo insignia de OpenAI ya está disponible: los resultados de la capacidad Critical, las salvaguardas y el plan de despliegue. Cambia Felo AI Search a GPT-6 Astra y pregunta lo que quieras.

Prueba GPT-6 Astra en Felo

Felo AI Search · Felo API · Lanzado el 3 de septiembre de 2026