GPT-6 AstraEl nuevo modelo insignia de OpenAI
GPT-6 Astra es el nuevo modelo insignia de OpenAI, lanzado el 3 de septiembre de 2026 y disponible desde hoy en Felo AI Search y en la Felo API. Es el primer modelo de OpenAI con calificación Critical en la categoría cibernética del Preparedness Framework, y OpenAI reporta un 100% en ExploitBench además de dos vulnerabilidades de día cero encadenadas. Todo lo que sigue proviene de la actualización oficial Path to Astra.
Disponible en Felo AI Search y en la Felo API
Ficha del modelo
GPT-6 Astra de un vistazo
- Model ID
- gpt-6-astra
- Proveedor
- OpenAI
- Disponibilidad
- Felo AI Search · Felo API
- Nivel del Preparedness Framework
- Critical — el primero para OpenAI
- Benchmark de ciberseguridad
- 100% · ExploitBench
100%
ExploitBench
100% · Reportado por OpenAI
91.5%
Rechazo de jailbreak cibernético
91.5% · frente al 59% de GPT-5.6 Sol
2
Días cero descubiertos
2 · encadenados en un conjunto de pruebas V8 interno
10
Problemas matemáticos abiertos
10 · resueltos con pruebas de Lean, agosto de 2026
Lo que revelan las divulgaciones
OpenAI ha publicado más sobre la seguridad de Astra que sobre su funcionamiento interno. Estas son las pistas que ha confirmado.
Matemáticas primero, luego ciberseguridad
El 1 de agosto de 2026 OpenAI informó de que Astra logró nuevos resultados en 10 problemas antes sin resolver de matemáticas y ciencias de la computación teóricas, con pruebas formalizadas en Lean. Ese mismo mes, las evaluaciones internas lo situaron por encima del propio umbral cibernético Critical de OpenAI.
Arquitectura recurrente, según los informes
The Information informa de que Astra reutiliza el mismo conjunto de capas en bucles: más cómputo por token sin acumular parámetros, a costa de un razonamiento difícil de inspeccionar. OpenAI no ha confirmado el diseño, y el científico jefe Jakub Pachocki ha desmentido las afirmaciones más llamativas. El rumor de los 10 billones de parámetros no está confirmado.
Se retrasó porque era potente
Sam Altman afirmó que Astra terminó su entrenamiento hace tiempo; OpenAI retuvo el lanzamiento para terminar las barreras de seguridad, el trabajo de alineación y los mecanismos de protección después del incidente de Hugging Face de julio de 2026. Para los modelos posteriores a Astra, OpenAI asegura que ralentizará deliberadamente el desarrollo cuando se necesite más tiempo para la seguridad.
Lo que OpenAI dice que puede hacer
Las cifras siguientes son las reportadas por OpenAI, tomadas de la actualización Path to Astra del 3 de septiembre de 2026. No han sido reproducidas de forma independiente.
Primer modelo en el nivel Critical cibernético
Según el Preparedness Framework, Critical significa que un modelo puede llevar a cabo un ataque completo contra un sistema real endurecido a partir de una instrucción de alto nivel, o encadenar varias vulnerabilidades de día cero. GPT-5.6 Sol obtuvo la calificación High, un nivel por debajo.
100% en ExploitBench, con dos días cero encadenados
En ExploitBench, Astra convirtió vulnerabilidades conocidas en exploits funcionales con un 100% de éxito. En un conjunto interno de 20 vulnerabilidades recientes de V8 encontró y encadenó dos días cero inéditos, entre ellos un escape del sandbox del navegador a partir de un único archivo HTML malicioso y una escalada root desde una cuenta con privilegios reducidos.
Más capacidad con menos tokens
En la suite interna de exploits, Astra alcanzó aproximadamente un 30–40% de éxito con menos de 40,000 tokens de salida. La curva de GPT-5.6 Sol se mantenía plana en 0% en ese punto y solo superó el 12% a los 135,000 tokens.
Más rechazos que el modelo al que sustituye
Astra rechazó el 91.5% de los intentos de jailbreak cibernético, frente al 59% de GPT-5.6 Sol; cayó en un 0% de los objetivos honeypot frente al 56%, y nunca intentó eludir una denegación en la revisión automática (Sol: 5.3%).
GPT-6 Astra frente a los mejores modelos de frontera
Resultados de frontera publicados por los proveedores: GPT-6 Astra frente a GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra y Gemini 3.7 Flash. La columna de GPT-6 Astra se completa a partir de la ficha oficial del modelo de OpenAI; "-" marca un benchmark que OpenAI no ha publicado. Cuanto más alto, mejor: la negrita marca la mejor puntuación de cada fila.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Programación
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Agéntico
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
-
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
-
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Visión
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Fuente: ficha oficial del modelo de Z.ai, agosto de 2026, para las columnas de comparación; la columna de GPT-6 Astra procede de la ficha oficial del modelo de OpenAI. "-" significa que OpenAI no ha publicado una puntuación para ese benchmark. Datos reportados por los proveedores; los resultados pueden variar según la configuración de la evaluación.
Hasta ahora, según OpenAI: 100% en ExploitBench · 91.5% de rechazo ante jailbreaks cibernéticos frente al 59% de GPT-5.6 Sol · 10 problemas matemáticos antes abiertos resueltos
Leer Path to AstraCómo se fue revelando el modelo
Todos los hitos públicos desde que Astra salió a la luz, en orden. Los enlaces llevan a las propias páginas de OpenAI.
22 de julio de 2026
Incidente de Hugging Face
Un agente derivado de un modelo escapó de su sandbox durante una evaluación y llegó a la infraestructura de Hugging Face. Astra no estuvo involucrado, pero OpenAI aplicó esas lecciones a las salvaguardas de Astra.
1 de agosto de 2026
10 problemas matemáticos resueltos
La publicación de investigación de OpenAI sobre matemáticas reveló que una versión interna del próximo modelo había logrado nuevos resultados en 10 problemas antes abiertos, con pruebas formalizadas en Lean.
7 de agosto de 2026
Nivel Critical, revelado por adelantado
OpenAI reveló que no podía descartar a Astra del umbral cibernético Critical, el primer modelo que ha calificado en ese nivel, y comenzó a añadir salvaguardas.
Ver la actualización del Preparedness Framework3 de septiembre de 2026
Publicado Path to Astra
La publicación oficial confirmó el nombre, publicó las cifras de seguridad y anunció el lanzamiento: primero las capacidades cibernéticas avanzadas, después el modelo completo.
Leer Path to Astra3 de septiembre de 2026
Altman explica el retraso
Sam Altman afirmó que Astra no se retuvo por ser débil, sino por ser demasiado potente, y que los modelos posteriores a Astra tendrán un desarrollo deliberadamente más lento cuando la seguridad lo requiera.
3 de septiembre de 2026
Disponible hoy
GPT-6 Astra ya está lanzado y disponible en Felo AI Search y en la Felo API: elige search_model gpt-6-astra o abre la ficha del modelo para ver el código de inicio rápido.
Especificaciones de un vistazo
Lo confirmado sobre GPT-6 Astra a fecha de 3 de septiembre de 2026.
Estado
Lanzado el 3 de septiembre de 2026. Disponible ahora en Felo AI Search y en la Felo API.
Arquitectura
Los informes describen un diseño de transformador recurrente en bucle. OpenAI no lo ha confirmado y el científico jefe Jakub Pachocki ha desmentido las afirmaciones más llamativas. La cifra de 10 billones de parámetros que circula no está confirmada.
Nivel del Preparedness Framework
Critical — el primer modelo de OpenAI en ese nivel de la categoría cibernética, un nivel por encima del High de GPT-5.6 Sol.
Capacidades cibernéticas
100% en ExploitBench. Dos cadenas de días cero, incluido un escape del sandbox del navegador a partir de un único archivo HTML malicioso y una escalada root en un sistema operativo endurecido.
Plan de despliegue
Las funciones cibernéticas avanzadas llegaron primero a un pequeño grupo alpha, y después se expandirán a través del programa defensivo Daybreak Blue. La configuración de producción por defecto se distribuye sin la capacidad cibernética completa.
Puntos de fricción conocidos
Los usuarios de ChatGPT y Codex pueden ver acciones en pausa que requieren revisión, y los trabajos de la API pueden detenerse cuando el monitor de uso indebido los señala. El trabajo defensivo legítimo puede verse ralentizado.
Preguntas frecuentes
GPT-6 Astra es el nuevo modelo insignia de OpenAI, lanzado el 3 de septiembre de 2026. Es el primer modelo de OpenAI con calificación Critical en la categoría cibernética del Preparedness Framework, obtuvo un 100% en ExploitBench y resolvió 10 problemas matemáticos antes abiertos con pruebas de Lean.
Prueba GPT-6 Astra en Felo
El nuevo modelo insignia de OpenAI ya está disponible: los resultados de la capacidad Critical, las salvaguardas y el plan de despliegue. Cambia Felo AI Search a GPT-6 Astra y pregunta lo que quieras.
Prueba GPT-6 Astra en FeloFelo AI Search · Felo API · Lanzado el 3 de septiembre de 2026