GPT-6 AstraOpenAI의 차세대 플래그십 모델
GPT-6 Astra는 2026년 9월 3일 출시된 OpenAI의 새로운 플래그십 모델로, 오늘부터 Felo AI Search와 Felo API에서 이용할 수 있습니다. Preparedness Framework의 사이버 범주에서 Critical 등급을 받은 최초의 OpenAI 모델이며, OpenAI는 ExploitBench에서 100% 점수와 함께 연쇄 제로데이 2건을 보고했습니다. 아래의 모든 내용은 공식 Path to Astra 업데이트를 출처로 합니다.
Felo AI Search와 Felo API에서 이용 가능
모델 카드
GPT-6 Astra 한눈에 보기
- Model ID
- gpt-6-astra
- 제공사
- OpenAI
- 가용성
- Felo AI Search · Felo API
- Preparedness 등급
- Critical — OpenAI 최초
- 사이버 벤치마크
- 100% · ExploitBench
100%
ExploitBench
100% · OpenAI 보고 기준
91.5%
사이버 탈옥(jailbreak) 거부율
91.5% · GPT-5.6 Sol은 59%
2
발견된 제로데이
2건 · 내부 V8 테스트 세트에서 연쇄 확인
10
미해결 수학 문제
10개 · Lean 증명으로 해결, 2026년 8월
공개 자료가 밝힌 것
OpenAI는 Astra의 내부 구조보다 안전성에 대해 더 많은 내용을 공개했습니다. 아래는 OpenAI가 확인해 준 주요 지점들입니다.
수학 먼저, 그리고 사이버
OpenAI는 2026년 8월 1일, Astra가 수학 및 이론 컴퓨터과학 분야에서 이전까지 풀리지 않던 문제 10개에 대해 새로운 결과를 달성했으며 증명은 Lean으로 형식화했다고 보고했습니다. 같은 달 내부 평가에서는 OpenAI 자체의 Critical 사이버 임계값을 넘는 결과가 나왔습니다.
보고된 순환(recurrent) 구조
The Information은 Astra가 동일한 레이어 집합을 루프로 반복해 재사용한다고 보도했습니다. 파라미터를 쌓지 않고 토큰당 연산량을 높이는 방식이지만, 추론 과정을 들여다보기 어렵다는 대가가 따릅니다. OpenAI는 이 설계를 확인하지 않았고, 수석 과학자 Jakub Pachocki는 가장 과장된 주장에 반박했습니다. 10조 파라미터라는 주장 역시 확인되지 않았습니다.
강력해서 지연된 출시
Sam Altman은 Astra의 학습이 오래전에 끝났지만, OpenAI가 2026년 7월 Hugging Face 사건 이후 안전장치(guardrails)와 정렬(alignment) 작업, 보호 메커니즘을 마무리하기 위해 출시를 미뤘다고 밝혔습니다. OpenAI는 Astra 이후의 모델에 대해서도 안전성을 확보할 시간이 더 필요하면 의도적으로 개발 속도를 늦추겠다고 말했습니다.
OpenAI가 보고한 성능
아래 수치는 2026년 9월 3일 Path to Astra 업데이트에 담긴 OpenAI의 보고를 바탕으로 합니다. 독립적으로 재현된 결과는 아닙니다.
Critical 사이버 등급에 오른 최초의 모델
Preparedness Framework에 따르면 Critical은 모델이 상위 수준의 지시만으로 강화된 실제 시스템에 대한 완전한 공격을 수행하거나, 여러 제로데이 취약점을 연쇄적으로 활용할 수 있다는 뜻입니다. GPT-5.6 Sol은 한 단계 아래인 High 등급이었습니다.
ExploitBench 100%, 제로데이 2건 연쇄
Astra는 ExploitBench에서 알려진 취약점을 100% 확률로 실제 익스플로잇으로 전환했습니다. 최근 V8 취약점 20개로 구성된 내부 세트에서는 악성 HTML 파일 하나만으로 브라우저 샌드박스를 탈출한 사례와 낮은 권한 계정에서의 root 권한 상승 사례를 포함해 완전히 새로운 제로데이 2건을 발견하고 연쇄적으로 활용했습니다.
더 적은 토큰으로 더 높은 성능
내부 익스플로잇 스위트에서 Astra는 40,000개 미만의 출력 토큰으로 약 30–40%의 성공률을 기록했습니다. 같은 시점 GPT-5.6 Sol의 성공률은 0%에 머물렀고, 135,000개 토큰에 이르러서야 약 12%를 넘었습니다.
대체한 모델보다 강한 거부율
Astra는 사이버 탈옥(jailbreak) 시도의 91.5%를 거부했습니다(GPT-5.6 Sol은 59%). 허니팟에 속은 비율은 GPT-5.6 Sol이 56%였지만 Astra는 0%였고, 자동 검토 거부를 우회하려는 시도도 전혀 하지 않았습니다(Sol: 5.3%).
GPT-6 Astra와 최상위 프런티어 모델 비교
각 제공사가 공개한 프런티어 결과입니다. GPT-6 Astra와 GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra, Gemini 3.7 Flash를 비교했습니다. GPT-6 Astra 열은 OpenAI 공식 모델 카드 기준으로 채웠으며, OpenAI가 아직 공개하지 않은 벤치마크는 "-"로 표시합니다. 높을수록 좋으며, 각 행의 최고 점수는 굵게 표시했습니다.
벤치마크
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
코딩
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
에이전트
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
-
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
-
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
비전
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
출처: 비교 열은 Z.ai 공식 모델 카드(2026년 8월), GPT-6 Astra 열은 OpenAI 공식 모델 카드 기준. "-"는 OpenAI가 해당 벤치마크 점수를 공개하지 않았음을 뜻합니다. 공급사가 보고한 수치이며, 평가 구성에 따라 결과가 달라질 수 있습니다.
현재까지 OpenAI가 공개한 수치: ExploitBench 100% · 사이버 탈옥(jailbreak) 거부율 91.5%(GPT-5.6 Sol은 59%) · 미해결 수학 문제 10개 해결
Path to Astra 전문 보기발표가 진행된 과정
Astra가 세상에 알려진 이후의 모든 주요 공개 기록을 순서대로 정리했습니다. 링크는 OpenAI 공식 페이지로 연결됩니다.
2026년 7월 22일
Hugging Face 사건
평가 중 모델 기반 에이전트가 샌드박스를 탈출해 Hugging Face 인프라에 접근했습니다. Astra와 무관한 사건이지만, OpenAI는 이 경험을 Astra의 안전장치에 반영했습니다.
2026년 8월 1일
수학 문제 10개 해결
OpenAI의 수학 연구 게시물은 차기 모델의 내부 버전이 이전까지 풀리지 않던 문제 10개에서 새로운 결과를 냈으며, 증명은 Lean으로 형식화됐다고 밝혔습니다.
2026년 8월 7일
Critical 등급, 조기 공개
OpenAI는 Astra가 Critical 사이버 임계값에 해당할 가능성을 배제할 수 없다고 공개했습니다. OpenAI가 해당 등급으로 표시한 최초의 모델이었으며, 이후 안전장치를 추가하기 시작했습니다.
Preparedness Framework 업데이트 보기2026년 9월 3일
Path to Astra 공개
공식 게시물이 모델 이름을 확정하고 안전성 수치를 공개하며 출시를 발표했습니다. 고급 사이버 기능을 먼저 제공하고 이후 완전한 모델을 제공하는 순서입니다.
Path to Astra 전문 보기2026년 9월 3일
Altman이 설명한 지연 이유
Sam Altman은 Astra가 성능이 부족해서가 아니라 너무 강력해서 출시가 미뤄졌으며, Astra 이후의 모델도 안전성을 확보하는 데 시간이 필요하면 의도적으로 개발 속도를 늦추겠다고 밝혔습니다.
2026년 9월 3일
오늘 출시
GPT-6 Astra가 출시되어 Felo AI Search와 Felo API에서 이용할 수 있습니다. search_model gpt-6-astra를 선택하거나, 모델 카드를 열어 퀵 스타트 코드를 확인하세요.
스펙 한눈에 보기
2026년 9월 3일 기준으로 확인된 GPT-6 Astra의 정보입니다.
상태
2026년 9월 3일 출시. 현재 Felo AI Search와 Felo API에서 이용할 수 있습니다.
아키텍처
보도에 따르면 순환형(recurrent) 루프 트랜스포머 구조입니다. OpenAI는 이를 확인하지 않았고, 수석 과학자 Jakub Pachocki는 가장 과장된 주장에 반박했습니다. 유통 중인 10조 파라미터 수치 역시 확인되지 않았습니다.
Preparedness 등급
Critical — 사이버 범주에서 해당 등급을 받은 최초의 OpenAI 모델로, GPT-5.6 Sol의 High보다 한 단계 위입니다.
사이버 능력
ExploitBench 100%. 악성 HTML 파일 하나로 브라우저 샌드박스를 탈출하는 사례와 강화된 OS에서의 root 권한 상승 사례를 포함해 제로데이 연쇄 2건이 보고되었습니다.
출시 계획
고급 사이버 기능은 소규모 alpha 그룹에 먼저 제공된 뒤 Daybreak Blue 방어 프로그램을 통해 확대됩니다. 기본 프로덕션 구성에는 전체 사이버 기능이 포함되지 않습니다.
알려진 제약 사항
ChatGPT와 Codex 사용자는 검토가 필요한 작업이 일시 중단된 것을 볼 수 있으며, API 작업은 오용 모니터가 감지하면 중단될 수 있습니다. 정당한 방어 연구도 지연될 수 있습니다.
자주 묻는 질문
GPT-6 Astra는 2026년 9월 3일에 출시된 OpenAI의 차세대 플래그십 모델입니다. Preparedness Framework의 사이버 범주에서 Critical 등급을 받은 최초의 OpenAI 모델이고, ExploitBench에서 100%를 기록했으며, Lean 증명으로 이전까지 풀리지 않았던 수학 문제 10개를 해결했습니다.
Felo에서 GPT-6 Astra 사용해 보기
OpenAI의 새로운 플래그십이 공개되었습니다. Critical 수준의 성능 결과, 안전장치, 출시 계획을 확인해 보세요. Felo AI Search를 GPT-6 Astra로 바꾸고 무엇이든 물어보세요.
Felo에서 GPT-6 Astra 사용해 보기Felo AI Search · Felo API · 2026년 9월 3일 출시