Tingkat Siber Critical Pertama · Dirilis 3 September 2026
GPT-6 Astra
GPT-6 Astra adalah model unggulan terbaru OpenAI, dirilis 3 September 2026 dan sudah tersedia di Felo AI Search serta Felo API hari ini.
- 100%
- ExploitBench
- 100% · berbanding 78.5% untuk GPT-5.6 Sol
- 98%
- FrontierMath Tier 4
- 98% · mencapai batas jenuh tier ini · ARC-AGI-3 99.9%
- 2
- Zero-day yang ditemukan
- 2 · ditemukan dalam evaluasi ExploitBench internal OpenAI, diungkapkan kepada para maintainer
- 59.3%
- Agents' Last Exam
- 59.3% · terbaik dalam perbandingan · 65% lebih sedikit token output daripada Opus 5
Apa yang Terungkap dari Pengumuman Resmi
OpenAI lebih banyak memublikasikan hal seputar keamanan Astra dibandingkan detail internalnya. Inilah poin-poin yang terkonfirmasi.

Matematika Lebih Dulu, Lalu Siber
Pada 1 Agustus 2026, OpenAI melaporkan bahwa Astra mencapai hasil baru pada 10 soal yang sebelumnya belum terpecahkan dalam matematika dan ilmu komputer teoretis, dengan bukti yang diformalkan dalam Lean. Pada 4 September, OpenAI membagikan dua hasil tambahan terkait selisih antara bilangan prima: batas 186 untuk selisih prima pendek, ditingkatkan dari 246, lalu dari 240 milik Julia Stadlmann, serta perbaikan pada satu suku dalam batas jangka panjang untuk selisih prima yang sangat besar, yang tidak berubah selama lebih dari 80 tahun. FrontierMath Tier 4 kini berada di titik jenuh dengan skor 98%. Di bulan yang sama, evaluasi internal menempatkannya di atas ambang batas siber Critical milik OpenAI sendiri.
Arsitektur Recurrent Menurut Pemberitaan
The Information melaporkan bahwa Astra memakai ulang set lapisan yang sama dalam perulangan, lebih banyak komputasi per token tanpa menumpuk parameter, dengan konsekuensi penalaran yang sulit diperiksa. Halaman produk OpenAI tidak mengungkap arsitektur maupun jumlah parameter apa pun, belum mengonfirmasi desain tersebut, dan ilmuwan utama Jakub Pachocki membantah klaim yang paling dramatis. Rumor 10 triliun parameter belum terkonfirmasi.
Ditunda karena Terlalu Kuat
Sam Altman menyebut pelatihan Astra sebenarnya selesai sejak lama; OpenAI menahan peluncuran demi menyelesaikan guardrail, pekerjaan penyelarasan, dan mekanisme perlindungan setelah insiden Hugging Face pada Juli 2026. Untuk model-model setelah Astra, OpenAI menyatakan akan sengaja memperlambat pengembangan bila dibutuhkan waktu lebih banyak untuk keamanan.
Apa yang Dilaporkan OpenAI tentang Kemampuannya
Angka di bawah dilaporkan oleh OpenAI, bersumber dari pembaruan keamanan 3 September dan halaman produk 4 September. Angka tersebut belum direproduksi secara independen.
Model Pertama di Tingkat Siber Critical
Dalam Preparedness Framework, Critical berarti model tersebut dapat menjalankan serangan penuh terhadap sistem nyata yang diperkuat hanya dari satu instruksi tingkat tinggi, atau merangkai beberapa celah zero-day. GPT-5.6 Sol dinilai High, satu tingkat di bawahnya. Astra juga merupakan model paling selaras milik OpenAI: dalam evaluasi yang disusun dengan mempertimbangkan insiden Hugging Face, ia melampaui sasaran yang diizinkan dalam 0% kasus, berbanding 48% untuk GPT-5.6 Sol, dan pada uji stres keamanan penggunaan komputer di halaman model, tingkat hasil yang tidak selarasnya adalah 2.4% berbanding 22.0% untuk Sol, dengan 9.5% untuk Claude Fable 5.1, 18.3% untuk Fable 5, dan 11.5% untuk Opus 5, nilai terendah di antara semua model frontier yang diuji.
100% di ExploitBench, Zero-day Ditemukan
Tanpa pengaman produksi, Astra mencetak 100% di ExploitBench (78.5% untuk GPT-5.6 Sol) dan 42.4% di ExploitGym (30.3% untuk Sol). Pada dataset ExploitBench baru (Juni-Agustus 2026), yang dibangun dari kerentanan tiga bulan sebelumnya, ia mencapai 39.0% berbanding 5.5% untuk Sol, dan selama evaluasi tersebut ia menemukan serta menggunakan dua zero-day yang sebelumnya tidak diketahui, yang kini diungkapkan OpenAI kepada para maintainer. Penilaian para ahli menemukan bahwa ia mencapai eksekusi kode arbitrer di peramban yang diperkuat serta eksploitasi eskalasi hak istimewa pada sistem operasi yang diperkuat.
Lebih Mampu dengan Token Lebih Sedikit
Dalam Agents' Last Exam, Astra mencetak 59.3% dengan memakai sekitar 65% lebih sedikit token output daripada Opus 5. Di OSWorld 2.0 ia mencapai 72.6% dalam sekitar 40 menit per tugas, berbanding 65.7% dalam sekitar 75 menit untuk GPT-5.6 Sol, 47% lebih cepat. Di Codex, kombinasi tersebut menyelesaikan tugas Mind2Web 1.9x lebih cepat, dan OpenAI melaporkan biaya API sekitar 9-86% lebih rendah pada benchmark yang ia ungguli. Astra juga dapat menyimpan catatan di berbagai context window dalam Codex, mempertahankan detail yang terkumpul alih-alih berulang kali memadatkannya menjadi satu ringkasan, saat ini masih eksperimental dan diaktifkan melalui config.toml, dan akan menjadi default untuk Astra dalam beberapa minggu ke depan, dengan context window sebelumnya tetap dapat dicari.
Penolakan Lebih Kuat Dibanding Model yang Digantikannya
Astra menolak 91.5% upaya jailbreak siber, berbanding 59% untuk GPT-5.6 Sol; menerima 0% target honeypot, berbanding 56%; tidak pernah mencoba mengakali sebuah penolakan peninjauan otomatis (Sol: 5.3%); dan kemungkinan mengeluarkan klaim yang tidak akurat tentang kemampuannya tiga kali lebih rendah. Pada evaluasi internal di halaman model, ia kemudian mencetak 0.00% berbanding 0.29% untuk Sol pada benchmark circumvention, serta 4.2% berbanding 12.2% pada halusinasi kemampuan.
GPT-6 Astra vs. Model Frontier Teratas
Hasil frontier yang dipublikasikan penyedia: GPT-6 Astra dibandingkan dengan GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra, dan Gemini 3.7 Flash. Kolom GPT-6 Astra diisi dari halaman model dan pembaruan keamanan OpenAI; tanda "-" menandai benchmark yang belum dipublikasikan OpenAI untuk Astra. Semakin tinggi semakin baik, tebal menandai skor terbaik di setiap baris.
Benchmark
GPT-6 Astra
GLM-5.2
DeepSeek-V4-Vision-Exp
Opus 4.8
GPT-5.6 Terra
Gemini 3.7 Flash
Coding
Terminal Bench 2.1
-
81.0
83.9
85.0
87.4
85.8
DeepSWE v1.1
-
46.2
59.3
58.0
69.6
65.3
NL2Repo
-
48.9
57.7
69.7
-
-
Agentic
Toolathlon Verified
-
59.9
75.9
76.2
74.9
-
AutomationBench v1.0.6
41.5
26.2
38.8
41.0
37.2
52.3
Agents' Last Exam
59.3
20.4
27.3
27.0
28.0
-
HLE w/ Tools
-
54.7
55.1
57.9
-
-
GDPval-AA v2
-
1504
1675
1582
1571
1527
Vision
OfficeQA Pro
-
-
57.9
48.9
-
-
CharXiv Reasoning w/ Tools
-
-
80.4
89.9
88.0
88.7
Chartography w/ Tools
-
-
64.3
75.0
68.0
65.0
BabyVision
-
-
35.1
46.8
61.6
70.9
MVbench
-
-
69.4
67.1
75.0
82.2
MMVU
-
-
72.7
67.4
75.8
82.3
Sumber: kartu model resmi Z.ai, Agustus 2026, untuk kolom perbandingan; kolom GPT-6 Astra diambil dari halaman model dan pembaruan keamanan OpenAI (3-4 September 2026), tanda "-" berarti OpenAI belum memublikasikan benchmark tersebut untuk Astra. Dilaporkan oleh penyedia; hasil dapat bervariasi tergantung konfigurasi evaluasi.
Dilaporkan OpenAI: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (99.2% dalam empat percobaan) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench
Baca halaman GPT-6 Astra milik OpenAIKurva biaya-akurasi resmi
OpenAI memetakan biaya API terhadap akurasi di halaman model. Grafik di bawah hanya mencakup GPT-6 Astra dan GPT-5.6 Sol; tabel mencantumkan skor terbaik yang dilaporkan untuk kelima model.
Benchmark
GPT-6 Astra
GPT-5.6 Sol
Claude Fable 5.1
Claude Fable 5
Claude Opus 5
OSWorld 2.0 · Offline
75.5% @ $9
65.5% @ $8.5
-
-
70% @ $24.5
ScreenSpot-Pro
93% @ $0.09
77% @ $0.045
-
-
-
Agents' Last Exam
59.3% @ $8
53.5% @ $4
-
48.5% (reported)
55.5% (reported)
ExploitGym honeypot (lower is better)
0.0%
48.2%
-
-
-
Terminal-Bench 4.0
57.5% @ $6.5
37.5% @ $8.5
56% @ $21
45% (reported)
52.5% (reported)
FrontierMath Tier 4 (v2)
97.5% @ $1
78% @ $0.4
87.5% (reported)
78% @ $4.75
72.5% (reported)
ARC-AGI-3
99.9%
7.8%
-
-
30.2%
Terminal-Bench Science 0.1
64.6% @ $35
22.5% (reported)
52.5% @ $35
21% (reported)
30% (reported)
AutomationBench
41.5% @ $1.75
18% @ $1.15
31% (reported)
17.5% @ $3.65
26.5% (reported)
Sumber: halaman model GPT-6 Astra milik OpenAI (4 September 2026). "@ $X" adalah biaya API pada skor terbaik; "reported" menandai satu skor yang dilaporkan tanpa kurva biaya. ExploitGym honeypot adalah satu-satunya metrik yang nilainya semakin rendah semakin baik.
Tabel Perbandingan Resmi Lengkap
Tabel lengkap dari halaman GPT-6 Astra milik OpenAI: sembilan kategori, 40 benchmark, enam model. Setiap skor adalah nilai maksimum pada tingkat usaha apa pun; tanda "-" berarti OpenAI belum melaporkan benchmark tersebut untuk model itu. Angka superskrip merujuk pada catatan kaki di halaman OpenAI.
Benchmark
GPT-6 Astra
GPT-5.6 Sol
Claude Fable 5.1
Claude Fable 5
Claude Opus 5
Gemini 3.8 Flash
Penggunaan Komputer
Agents' Last Exam
59.3%
53.6%
-
48.7%
55.5%
-
OSWorld 2.0 (v2026.08.08, offline set, partial score)
72.6%
65.7%
-
-
70.2%³
-
ScreenSpot-Pro (no tools)
92.7%
76.9%
-
87.3%¹⁷
-
-
Profesional
AutomationBench
41.4%
18.1%
31.4%
17.4%
26.9%
-
BenchCAD
95.9%
83.3%
84.3%⁵
67.5%⁵
82.1%⁵
-
BrowseComp
91.5%
90.4%
-
87.4%
90.8%
-
OpenScore String Quartets (1 - OMR-NED)
0.84
0.19
-
-
-
-
Internal Design Tasks
50.0%
47.4%
-
35.8%
-
-
Internal Data Science Tasks
40.9%
30.5%
-
34.7%
-
-
Artificial Analysis Intelligence Index v4.1.1
61.2
60.9
65.7
62.1
63.1
58.7
Coding
Terminal-Bench 4.0
57.9%
37.3%
55.8%
44.5%
52.6%
19.1%
DeepSWE v1.1
74.1%
72.7%
67.4%
69.9%
73.7%
73.8%
FrontierCode 1.1 Extended (score)
64.5%⁸
60.6%
63.6%
64.9%
63.6%
56.3%
FrontierCode 1.1 Main (score)
53.3%⁸
47.5%
50.9%
53.5%
53.4%
43.6%
Internal Database Migration Tasks
63.9%
42.7%
57.8%
50.3%
-
-
Artificial Analysis Coding Agent Index v1.4
67.0
65.1
-
67.2
68.1
61.2
Akademik
Terminal-Bench Science 0.1
64.6%
22.4%
52.6%
21.4%
30.0%
-
FrontierMath Tier 4 (v2)
97.6%
83.0%
87.8%
87.8%
73.2%
-
GPQA Diamond
96.0%
94.6%
93.7%
92.6%
93.7%
95.3%
Humanity's Last Exam (w/ tools)
57.2%
-
65.0%
63.8%
63.6%
-
Sains dan Kesehatan
GeneBench Pro
37.1%
32.3%
-
-
-
-
MedChemBench (Internal)
49.3%
47.4%
-
-
-
-
LifeSciBench
60.3%
59.9%
-
-
-
-
HealthBench Professional (length-adjusted)
63.4%
60.5%
58.1%¹¹
60.9%¹¹
56.4%¹¹
52.1%
Keamanan Siber
ExploitBench
100.0%
78.5%
-
-
70%
-
ExploitGym
42.4%¹³
30.3%¹³
30.4%¹⁷
28.4%¹⁷
22.0%
-
ExploitBench (June-August 2026)
39.0%
5.5%
-
-
-
-
SRE-Bench
88.0%
55.9%
-
-
12.5%
-
SEC-Bench Pro
85.4%
79.1%
-
-
-
-
Penyelarasan
Internal computer use safety benchmark (lower is better)
2.4%
22.0%
9.5%
18.3%
11.5%
-
Internal computer use safety benchmark, w/ AutoReview (lower is better)
1.8%
4.3%
-
-
-
-
Internal circumvention benchmark (lower is better)
0.00%
0.29%
-
-
-
-
ExploitGym honeypot (lower is better)
0.0%
48.2%
-
-
-
-
Impossible ExploitGym
100.0%
-
-
-
-
-
Internal hallucination benchmark (lower is better)
4.2%
12.2%
-
-
-
-
Konteks Panjang
OpenAI MRCR v2 8-needle 256K-512K
100.0%
91.5%
-
-
-
-
OpenAI MRCR v2 8-needle 512K-1M
96.3%
73.8%
-
-
-
-
Penalaran Abstrak
ARC-AGI-3
99.9%¹
7.8%
-
-
30.2%
-
ARC-AGI-2
95.0%
92.5%
90.0%
89.2%
90.4%
-
ARC-AGI-1
98.5%
97.5%
97.5%
98.5%
97.5%
-
Sumber: halaman model GPT-6 Astra milik OpenAI (4 September 2026). Angka superskrip adalah penanda catatan kaki OpenAI: ¹ ARC-AGI-3 dijalankan dengan harness Responses API; ³ skor OSWorld 2.0 untuk Opus 5 direproduksi oleh penulis benchmark tersebut di leaderboard resmi; ⁵ skor BenchCAD untuk Claude mencerminkan tiga modifikasi pada evaluasi; ⁸ skor FrontierCode untuk Astra menggunakan pesan developer yang mencerminkan pengaturan Codex-nya; ¹¹ skor HealthBench Professional untuk model Claude dievaluasi secara independen oleh OpenAI; ¹³ ExploitGym dijalankan tanpa batas waktu 6 jam untuk Astra dan Sol; ¹⁷ skor ScreenSpot-Pro dan ExploitGym untuk Fable berasal dari Mythos, Fable dengan pengaman yang lebih sedikit. GPT-5.6 Sol adalah versi yang tersedia di OpenAI API, Codex, dan ChatGPT Work.
Harga Standar OpenAI API
GPT-6 Astra tersedia bagi para developer sebagai gpt-6-astra di OpenAI API serta melalui Microsoft Azure dan AWS Bedrock. Berikut tarif API yang dipublikasikan.
| Token input | $10 | per juta token input |
|---|---|---|
| Token output | $50 | per juta token output |
| Mode cepat | 2x | hingga 2x kecepatan pemrosesan Standard dengan harga 2x harga Standard |
Pemakaian sudah termasuk dalam kuota langganan ChatGPT yang ada, dan pengguna maupun bisnis dapat membeli kredit untuk pemakaian tambahan. Tarif terpisah yang dipublikasikan berlaku untuk pembacaan dan penulisan cache. Zero Data Retention tersedia bagi pelanggan API yang memenuhi syarat, dan OpenAI sedang menguji Private Safety Processing untuk memperkuat pemantauan keamanan sambil menjaga privasi pelanggan.
Sumber: halaman model GPT-6 Astra milik OpenAI (4 September 2026).
Bagaimana Penemuan Ini Terungkap
Semua tonggak publik sejak Astra pertama kali muncul, secara berurutan. Tautan mengarah ke halaman resmi OpenAI.
22 Juli 2026
Insiden Hugging Face
Sebuah agen yang diturunkan dari sebuah model lolos dari sandbox saat evaluasi dan mencapai infrastruktur Hugging Face. Astra tidak terlibat, tetapi OpenAI menerapkan pelajaran tersebut pada pengaman Astra.
1 Agustus 2026
10 soal matematika terpecahkan
Postingan riset OpenAI tentang matematika mengungkap bahwa versi internal dari model berikutnya mencapai hasil baru pada 10 soal yang sebelumnya terbuka, dengan bukti yang diformalkan dalam Lean.
7 Agustus 2026
Tingkat Critical, diungkap lebih awal
OpenAI mengungkap bahwa Astra tidak dapat dilepaskan dari ambang batas siber Critical, model pertama yang pernah diberi label pada tingkat tersebut, dan mulai menambahkan pengaman.
Lihat pembaruan Preparedness Framework3 September 2026
Path to Astra dipublikasikan
Postingan resmi tersebut mengonfirmasi nama, memublikasikan angka keamanan, dan mengumumkan peluncuran: kemampuan siber lanjutan lebih dulu, disusul model lengkap.
Baca Path to Astra3 September 2026
Altman menjelaskan penundaan
Sam Altman menyampaikan bahwa Astra ditahan bukan karena lemah, melainkan karena terlalu kuat, dan model-model setelah Astra akan sengaja dikembangkan lebih lambat bila keamanan membutuhkan waktu tersebut.
3 September 2026
Aktif hari ini
GPT-6 Astra telah dirilis dan tersedia di Felo AI Search serta Felo API, pilih search_model gpt-6-astra, atau buka kartu model untuk melihat kode quick-start.
4 September 2026
Halaman model lengkap dipublikasikan
OpenAI memublikasikan halaman model lengkap: hasil benchmark, sorotan penggunaan komputer dan pekerjaan profesional, harga API, serta rencana peluncuran bertahap, organisasi tertentu hari ini, lalu seluruh pengguna ChatGPT Plus, Pro, Business, dan Enterprise, ditambah OpenAI API, Microsoft Azure, dan AWS Bedrock dalam beberapa hari ke depan.
Baca halaman GPT-6 Astra milik OpenAI
Spesifikasi Sekilas
Apa yang sudah terkonfirmasi tentang GPT-6 Astra per 4 September 2026.
Status
Dirilis pada 3 September 2026 bersamaan dengan pembaruan keamanan; halaman model lengkap menyusul pada 4 September. Hari ini mulai digulirkan ke sejumlah organisasi terbatas, lalu ke semua pengguna ChatGPT Plus, Pro, Business, dan Enterprise, ditambah OpenAI API, Microsoft Azure, dan AWS Bedrock. Pengguna Pro, Business, dan Enterprise juga mendapatkan GPT-6 Astra Pro. Sudah aktif di Felo AI Search dan Felo API sekarang.
Arsitektur
Pemberitaan menggambarkan desain transformer recurrent dengan perulangan. Halaman produk OpenAI tidak mengungkap arsitektur maupun jumlah parameter, belum mengonfirmasi desain tersebut, dan ilmuwan utama Jakub Pachocki membantah klaim yang paling dramatis. Angka 10 triliun parameter yang beredar belum terkonfirmasi.
Tingkat Preparedness
Critical, model OpenAI pertama pada tingkat tersebut untuk kategori siber, satu tingkat di atas High milik GPT-5.6 Sol. OpenAI juga menyebutnya sebagai model paling selaras miliknya, dengan perilaku di luar sasaran yang diizinkan sebesar 0%, berbanding 48% untuk Sol. Ia menolak tugas siber tingkat lanjut seperti exploit proof-of-concept, dengan pengaman yang akan semakin longgar lewat OpenAI Daybreak.
Kemampuan siber
100% di ExploitBench berbanding 78.5% untuk GPT-5.6 Sol, 42.4% di ExploitGym berbanding 30.3%, serta 88.0% di SRE-Bench dalam satu percobaan (99.2% dalam empat percobaan), berbanding 55.9%/68.7%. Dua zero-day ditemukan selama evaluasi internal dan diungkapkan kepada para maintainer.
Rencana peluncuran bertahap
Organisasi terbatas hari ini, lalu semua pengguna ChatGPT Plus, Pro, Business, dan Enterprise; developer mendapatkannya melalui OpenAI API (model ID gpt-6-astra), Microsoft Azure, dan AWS Bedrock. Pemakaian sudah termasuk dalam kuota langganan yang ada, dengan kredit tambahan yang dapat dibeli; pengguna Pro, Business, dan Enterprise juga mendapatkan GPT-6 Astra Pro, dan admin Enterprise mengaktifkan Astra untuk workspace mereka, nonaktif secara default saat peluncuran. Fitur siber tingkat lanjut tetap dibatasi: konfigurasi produksi default dirilis tanpa kemampuan siber penuh, dengan OpenAI Daybreak memperluas akses dalam beberapa minggu ke depan.
Kendala yang diketahui
Pengguna ChatGPT dan Codex dapat melihat tindakan yang dijeda menunggu peninjauan, dan pekerjaan API bisa berhenti saat pemantauan penyalahgunaan menandainya. OpenAI juga menyoroti bahwa penalaran tertulis Astra menjadi lebih sulit dipantau dibandingkan GPT-5.6 Sol, dan menjadikan peningkatan kemampuan pemantauan sebagai prioritas riset. Pekerjaan pertahanan yang sah juga berisiko diperlambat.
Pertanyaan yang Sering Diajukan
GPT-6 Astra adalah model unggulan terbaru OpenAI, dirilis 3 September 2026 dan disebut oleh OpenAI sebagai model paling cerdas dan paling selaras di dunia. Model ini adalah yang pertama dinilai Critical pada kategori siber Preparedness Framework, mencetak 100% di ExploitBench dan 98% di FrontierMath Tier 4, berada pada titik jenuh ARC-AGI-3 dengan skor 99.9%, serta mencatatkan rekor penggunaan komputer terbaik di kelasnya.
Coba GPT-6 Astra di Felo
Model unggulan terbaru OpenAI sudah aktif: hasil benchmark, rekor penggunaan komputer dan pekerjaan profesional, pengaman, serta rencana peluncuran bertahap. Ganti Felo AI Search ke GPT-6 Astra dan tanyakan apa saja.
Coba Felo Astra ResearchDirilis 3 September 2026
