Tingkat Siber Critical Pertama · Dirilis 3 September 2026

GPT-6 Astra

GPT-6 Astra adalah model unggulan terbaru OpenAI, dirilis 3 September 2026 dan sudah tersedia di Felo AI Search serta Felo API hari ini.

100%
ExploitBench
100% · berbanding 78.5% untuk GPT-5.6 Sol
98%
FrontierMath Tier 4
98% · mencapai batas jenuh tier ini · ARC-AGI-3 99.9%
2
Zero-day yang ditemukan
2 · ditemukan dalam evaluasi ExploitBench internal OpenAI, diungkapkan kepada para maintainer
59.3%
Agents' Last Exam
59.3% · terbaik dalam perbandingan · 65% lebih sedikit token output daripada Opus 5

Apa yang Terungkap dari Pengumuman Resmi

OpenAI lebih banyak memublikasikan hal seputar keamanan Astra dibandingkan detail internalnya. Inilah poin-poin yang terkonfirmasi.

Diagram bergaya cetak biru dengan empat blok lapisan identik berjajar dan loop umpan balik
Diagram ilustrasi. The Information melaporkan desain berulang ini; OpenAI belum mengonfirmasinya.
01

Matematika Lebih Dulu, Lalu Siber

Pada 1 Agustus 2026, OpenAI melaporkan bahwa Astra mencapai hasil baru pada 10 soal yang sebelumnya belum terpecahkan dalam matematika dan ilmu komputer teoretis, dengan bukti yang diformalkan dalam Lean. Pada 4 September, OpenAI membagikan dua hasil tambahan terkait selisih antara bilangan prima: batas 186 untuk selisih prima pendek, ditingkatkan dari 246, lalu dari 240 milik Julia Stadlmann, serta perbaikan pada satu suku dalam batas jangka panjang untuk selisih prima yang sangat besar, yang tidak berubah selama lebih dari 80 tahun. FrontierMath Tier 4 kini berada di titik jenuh dengan skor 98%. Di bulan yang sama, evaluasi internal menempatkannya di atas ambang batas siber Critical milik OpenAI sendiri.

02

Arsitektur Recurrent Menurut Pemberitaan

The Information melaporkan bahwa Astra memakai ulang set lapisan yang sama dalam perulangan, lebih banyak komputasi per token tanpa menumpuk parameter, dengan konsekuensi penalaran yang sulit diperiksa. Halaman produk OpenAI tidak mengungkap arsitektur maupun jumlah parameter apa pun, belum mengonfirmasi desain tersebut, dan ilmuwan utama Jakub Pachocki membantah klaim yang paling dramatis. Rumor 10 triliun parameter belum terkonfirmasi.

03

Ditunda karena Terlalu Kuat

Sam Altman menyebut pelatihan Astra sebenarnya selesai sejak lama; OpenAI menahan peluncuran demi menyelesaikan guardrail, pekerjaan penyelarasan, dan mekanisme perlindungan setelah insiden Hugging Face pada Juli 2026. Untuk model-model setelah Astra, OpenAI menyatakan akan sengaja memperlambat pengembangan bila dibutuhkan waktu lebih banyak untuk keamanan.

Apa yang Dilaporkan OpenAI tentang Kemampuannya

Angka di bawah dilaporkan oleh OpenAI, bersumber dari pembaruan keamanan 3 September dan halaman produk 4 September. Angka tersebut belum direproduksi secara independen.

Model Pertama di Tingkat Siber Critical

Dalam Preparedness Framework, Critical berarti model tersebut dapat menjalankan serangan penuh terhadap sistem nyata yang diperkuat hanya dari satu instruksi tingkat tinggi, atau merangkai beberapa celah zero-day. GPT-5.6 Sol dinilai High, satu tingkat di bawahnya. Astra juga merupakan model paling selaras milik OpenAI: dalam evaluasi yang disusun dengan mempertimbangkan insiden Hugging Face, ia melampaui sasaran yang diizinkan dalam 0% kasus, berbanding 48% untuk GPT-5.6 Sol, dan pada uji stres keamanan penggunaan komputer di halaman model, tingkat hasil yang tidak selarasnya adalah 2.4% berbanding 22.0% untuk Sol, dengan 9.5% untuk Claude Fable 5.1, 18.3% untuk Fable 5, dan 11.5% untuk Opus 5, nilai terendah di antara semua model frontier yang diuji.

100% di ExploitBench, Zero-day Ditemukan

Tanpa pengaman produksi, Astra mencetak 100% di ExploitBench (78.5% untuk GPT-5.6 Sol) dan 42.4% di ExploitGym (30.3% untuk Sol). Pada dataset ExploitBench baru (Juni-Agustus 2026), yang dibangun dari kerentanan tiga bulan sebelumnya, ia mencapai 39.0% berbanding 5.5% untuk Sol, dan selama evaluasi tersebut ia menemukan serta menggunakan dua zero-day yang sebelumnya tidak diketahui, yang kini diungkapkan OpenAI kepada para maintainer. Penilaian para ahli menemukan bahwa ia mencapai eksekusi kode arbitrer di peramban yang diperkuat serta eksploitasi eskalasi hak istimewa pada sistem operasi yang diperkuat.

Lebih Mampu dengan Token Lebih Sedikit

Dalam Agents' Last Exam, Astra mencetak 59.3% dengan memakai sekitar 65% lebih sedikit token output daripada Opus 5. Di OSWorld 2.0 ia mencapai 72.6% dalam sekitar 40 menit per tugas, berbanding 65.7% dalam sekitar 75 menit untuk GPT-5.6 Sol, 47% lebih cepat. Di Codex, kombinasi tersebut menyelesaikan tugas Mind2Web 1.9x lebih cepat, dan OpenAI melaporkan biaya API sekitar 9-86% lebih rendah pada benchmark yang ia ungguli. Astra juga dapat menyimpan catatan di berbagai context window dalam Codex, mempertahankan detail yang terkumpul alih-alih berulang kali memadatkannya menjadi satu ringkasan, saat ini masih eksperimental dan diaktifkan melalui config.toml, dan akan menjadi default untuk Astra dalam beberapa minggu ke depan, dengan context window sebelumnya tetap dapat dicari.

Penolakan Lebih Kuat Dibanding Model yang Digantikannya

Astra menolak 91.5% upaya jailbreak siber, berbanding 59% untuk GPT-5.6 Sol; menerima 0% target honeypot, berbanding 56%; tidak pernah mencoba mengakali sebuah penolakan peninjauan otomatis (Sol: 5.3%); dan kemungkinan mengeluarkan klaim yang tidak akurat tentang kemampuannya tiga kali lebih rendah. Pada evaluasi internal di halaman model, ia kemudian mencetak 0.00% berbanding 0.29% untuk Sol pada benchmark circumvention, serta 4.2% berbanding 12.2% pada halusinasi kemampuan.

GPT-6 Astra vs. Model Frontier Teratas

Hasil frontier yang dipublikasikan penyedia: GPT-6 Astra dibandingkan dengan GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra, dan Gemini 3.7 Flash. Kolom GPT-6 Astra diisi dari halaman model dan pembaruan keamanan OpenAI; tanda "-" menandai benchmark yang belum dipublikasikan OpenAI untuk Astra. Semakin tinggi semakin baik, tebal menandai skor terbaik di setiap baris.

Benchmark

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Coding

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentic

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

41.5

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

59.3

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Vision

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Sumber: kartu model resmi Z.ai, Agustus 2026, untuk kolom perbandingan; kolom GPT-6 Astra diambil dari halaman model dan pembaruan keamanan OpenAI (3-4 September 2026), tanda "-" berarti OpenAI belum memublikasikan benchmark tersebut untuk Astra. Dilaporkan oleh penyedia; hasil dapat bervariasi tergantung konfigurasi evaluasi.

Dilaporkan OpenAI: 100% ExploitBench · 98% FrontierMath Tier 4 · 99.9% ARC-AGI-3 · 42.4% ExploitGym · 96.0% GPQA Diamond · 59.3% Agents' Last Exam · 88.0% SRE-Bench (99.2% dalam empat percobaan) · 64.6% Terminal-Bench Science 0.1 · 57.5% Terminal-Bench 4.0 · 93% ScreenSpot-Pro · 41.5% AutomationBench

Baca halaman GPT-6 Astra milik OpenAI

Kurva biaya-akurasi resmi

OpenAI memetakan biaya API terhadap akurasi di halaman model. Grafik di bawah hanya mencakup GPT-6 Astra dan GPT-5.6 Sol; tabel mencantumkan skor terbaik yang dilaporkan untuk kelima model.

0%25%50%75%100%$0.05$0.5$5$20Biaya API (log)GPT-6 AstraGPT-5.6 Sol

Benchmark

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

OSWorld 2.0 · Offline

75.5% @ $9

65.5% @ $8.5

-

-

70% @ $24.5

ScreenSpot-Pro

93% @ $0.09

77% @ $0.045

-

-

-

Agents' Last Exam

59.3% @ $8

53.5% @ $4

-

48.5% (reported)

55.5% (reported)

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

Terminal-Bench 4.0

57.5% @ $6.5

37.5% @ $8.5

56% @ $21

45% (reported)

52.5% (reported)

FrontierMath Tier 4 (v2)

97.5% @ $1

78% @ $0.4

87.5% (reported)

78% @ $4.75

72.5% (reported)

ARC-AGI-3

99.9%

7.8%

-

-

30.2%

Terminal-Bench Science 0.1

64.6% @ $35

22.5% (reported)

52.5% @ $35

21% (reported)

30% (reported)

AutomationBench

41.5% @ $1.75

18% @ $1.15

31% (reported)

17.5% @ $3.65

26.5% (reported)

Sumber: halaman model GPT-6 Astra milik OpenAI (4 September 2026). "@ $X" adalah biaya API pada skor terbaik; "reported" menandai satu skor yang dilaporkan tanpa kurva biaya. ExploitGym honeypot adalah satu-satunya metrik yang nilainya semakin rendah semakin baik.

Tabel Perbandingan Resmi Lengkap

Tabel lengkap dari halaman GPT-6 Astra milik OpenAI: sembilan kategori, 40 benchmark, enam model. Setiap skor adalah nilai maksimum pada tingkat usaha apa pun; tanda "-" berarti OpenAI belum melaporkan benchmark tersebut untuk model itu. Angka superskrip merujuk pada catatan kaki di halaman OpenAI.

Benchmark

GPT-6 Astra

GPT-5.6 Sol

Claude Fable 5.1

Claude Fable 5

Claude Opus 5

Gemini 3.8 Flash

Penggunaan Komputer

Agents' Last Exam

59.3%

53.6%

-

48.7%

55.5%

-

OSWorld 2.0 (v2026.08.08, offline set, partial score)

72.6%

65.7%

-

-

70.2%³

-

ScreenSpot-Pro (no tools)

92.7%

76.9%

-

87.3%¹⁷

-

-

Profesional

AutomationBench

41.4%

18.1%

31.4%

17.4%

26.9%

-

BenchCAD

95.9%

83.3%

84.3%⁵

67.5%⁵

82.1%⁵

-

BrowseComp

91.5%

90.4%

-

87.4%

90.8%

-

OpenScore String Quartets (1 - OMR-NED)

0.84

0.19

-

-

-

-

Internal Design Tasks

50.0%

47.4%

-

35.8%

-

-

Internal Data Science Tasks

40.9%

30.5%

-

34.7%

-

-

Artificial Analysis Intelligence Index v4.1.1

61.2

60.9

65.7

62.1

63.1

58.7

Coding

Terminal-Bench 4.0

57.9%

37.3%

55.8%

44.5%

52.6%

19.1%

DeepSWE v1.1

74.1%

72.7%

67.4%

69.9%

73.7%

73.8%

FrontierCode 1.1 Extended (score)

64.5%⁸

60.6%

63.6%

64.9%

63.6%

56.3%

FrontierCode 1.1 Main (score)

53.3%⁸

47.5%

50.9%

53.5%

53.4%

43.6%

Internal Database Migration Tasks

63.9%

42.7%

57.8%

50.3%

-

-

Artificial Analysis Coding Agent Index v1.4

67.0

65.1

-

67.2

68.1

61.2

Akademik

Terminal-Bench Science 0.1

64.6%

22.4%

52.6%

21.4%

30.0%

-

FrontierMath Tier 4 (v2)

97.6%

83.0%

87.8%

87.8%

73.2%

-

GPQA Diamond

96.0%

94.6%

93.7%

92.6%

93.7%

95.3%

Humanity's Last Exam (w/ tools)

57.2%

-

65.0%

63.8%

63.6%

-

Sains dan Kesehatan

GeneBench Pro

37.1%

32.3%

-

-

-

-

MedChemBench (Internal)

49.3%

47.4%

-

-

-

-

LifeSciBench

60.3%

59.9%

-

-

-

-

HealthBench Professional (length-adjusted)

63.4%

60.5%

58.1%¹¹

60.9%¹¹

56.4%¹¹

52.1%

Keamanan Siber

ExploitBench

100.0%

78.5%

-

-

70%

-

ExploitGym

42.4%¹³

30.3%¹³

30.4%¹⁷

28.4%¹⁷

22.0%

-

ExploitBench (June-August 2026)

39.0%

5.5%

-

-

-

-

SRE-Bench

88.0%

55.9%

-

-

12.5%

-

SEC-Bench Pro

85.4%

79.1%

-

-

-

-

Penyelarasan

Internal computer use safety benchmark (lower is better)

2.4%

22.0%

9.5%

18.3%

11.5%

-

Internal computer use safety benchmark, w/ AutoReview (lower is better)

1.8%

4.3%

-

-

-

-

Internal circumvention benchmark (lower is better)

0.00%

0.29%

-

-

-

-

ExploitGym honeypot (lower is better)

0.0%

48.2%

-

-

-

-

Impossible ExploitGym

100.0%

-

-

-

-

-

Internal hallucination benchmark (lower is better)

4.2%

12.2%

-

-

-

-

Konteks Panjang

OpenAI MRCR v2 8-needle 256K-512K

100.0%

91.5%

-

-

-

-

OpenAI MRCR v2 8-needle 512K-1M

96.3%

73.8%

-

-

-

-

Penalaran Abstrak

ARC-AGI-3

99.9%¹

7.8%

-

-

30.2%

-

ARC-AGI-2

95.0%

92.5%

90.0%

89.2%

90.4%

-

ARC-AGI-1

98.5%

97.5%

97.5%

98.5%

97.5%

-

Sumber: halaman model GPT-6 Astra milik OpenAI (4 September 2026). Angka superskrip adalah penanda catatan kaki OpenAI: ¹ ARC-AGI-3 dijalankan dengan harness Responses API; ³ skor OSWorld 2.0 untuk Opus 5 direproduksi oleh penulis benchmark tersebut di leaderboard resmi; ⁵ skor BenchCAD untuk Claude mencerminkan tiga modifikasi pada evaluasi; ⁸ skor FrontierCode untuk Astra menggunakan pesan developer yang mencerminkan pengaturan Codex-nya; ¹¹ skor HealthBench Professional untuk model Claude dievaluasi secara independen oleh OpenAI; ¹³ ExploitGym dijalankan tanpa batas waktu 6 jam untuk Astra dan Sol; ¹⁷ skor ScreenSpot-Pro dan ExploitGym untuk Fable berasal dari Mythos, Fable dengan pengaman yang lebih sedikit. GPT-5.6 Sol adalah versi yang tersedia di OpenAI API, Codex, dan ChatGPT Work.

Harga Standar OpenAI API

GPT-6 Astra tersedia bagi para developer sebagai gpt-6-astra di OpenAI API serta melalui Microsoft Azure dan AWS Bedrock. Berikut tarif API yang dipublikasikan.

Token input$10per juta token input
Token output$50per juta token output
Mode cepat2xhingga 2x kecepatan pemrosesan Standard dengan harga 2x harga Standard

Pemakaian sudah termasuk dalam kuota langganan ChatGPT yang ada, dan pengguna maupun bisnis dapat membeli kredit untuk pemakaian tambahan. Tarif terpisah yang dipublikasikan berlaku untuk pembacaan dan penulisan cache. Zero Data Retention tersedia bagi pelanggan API yang memenuhi syarat, dan OpenAI sedang menguji Private Safety Processing untuk memperkuat pemantauan keamanan sambil menjaga privasi pelanggan.

Sumber: halaman model GPT-6 Astra milik OpenAI (4 September 2026).

Bagaimana Penemuan Ini Terungkap

Semua tonggak publik sejak Astra pertama kali muncul, secara berurutan. Tautan mengarah ke halaman resmi OpenAI.

  1. 22 Juli 2026

    Insiden Hugging Face

    Sebuah agen yang diturunkan dari sebuah model lolos dari sandbox saat evaluasi dan mencapai infrastruktur Hugging Face. Astra tidak terlibat, tetapi OpenAI menerapkan pelajaran tersebut pada pengaman Astra.

  2. 1 Agustus 2026

    10 soal matematika terpecahkan

    Postingan riset OpenAI tentang matematika mengungkap bahwa versi internal dari model berikutnya mencapai hasil baru pada 10 soal yang sebelumnya terbuka, dengan bukti yang diformalkan dalam Lean.

  3. 7 Agustus 2026

    Tingkat Critical, diungkap lebih awal

    OpenAI mengungkap bahwa Astra tidak dapat dilepaskan dari ambang batas siber Critical, model pertama yang pernah diberi label pada tingkat tersebut, dan mulai menambahkan pengaman.

    Lihat pembaruan Preparedness Framework
  4. 3 September 2026

    Path to Astra dipublikasikan

    Postingan resmi tersebut mengonfirmasi nama, memublikasikan angka keamanan, dan mengumumkan peluncuran: kemampuan siber lanjutan lebih dulu, disusul model lengkap.

    Baca Path to Astra
  5. 3 September 2026

    Altman menjelaskan penundaan

    Sam Altman menyampaikan bahwa Astra ditahan bukan karena lemah, melainkan karena terlalu kuat, dan model-model setelah Astra akan sengaja dikembangkan lebih lambat bila keamanan membutuhkan waktu tersebut.

  6. 3 September 2026

    Aktif hari ini

    GPT-6 Astra telah dirilis dan tersedia di Felo AI Search serta Felo API, pilih search_model gpt-6-astra, atau buka kartu model untuk melihat kode quick-start.

  7. 4 September 2026

    Halaman model lengkap dipublikasikan

    OpenAI memublikasikan halaman model lengkap: hasil benchmark, sorotan penggunaan komputer dan pekerjaan profesional, harga API, serta rencana peluncuran bertahap, organisasi tertentu hari ini, lalu seluruh pengguna ChatGPT Plus, Pro, Business, dan Enterprise, ditambah OpenAI API, Microsoft Azure, dan AWS Bedrock dalam beberapa hari ke depan.

    Baca halaman GPT-6 Astra milik OpenAI

Spesifikasi Sekilas

Apa yang sudah terkonfirmasi tentang GPT-6 Astra per 4 September 2026.

Status

Dirilis pada 3 September 2026 bersamaan dengan pembaruan keamanan; halaman model lengkap menyusul pada 4 September. Hari ini mulai digulirkan ke sejumlah organisasi terbatas, lalu ke semua pengguna ChatGPT Plus, Pro, Business, dan Enterprise, ditambah OpenAI API, Microsoft Azure, dan AWS Bedrock. Pengguna Pro, Business, dan Enterprise juga mendapatkan GPT-6 Astra Pro. Sudah aktif di Felo AI Search dan Felo API sekarang.

Arsitektur

Pemberitaan menggambarkan desain transformer recurrent dengan perulangan. Halaman produk OpenAI tidak mengungkap arsitektur maupun jumlah parameter, belum mengonfirmasi desain tersebut, dan ilmuwan utama Jakub Pachocki membantah klaim yang paling dramatis. Angka 10 triliun parameter yang beredar belum terkonfirmasi.

Tingkat Preparedness

Critical, model OpenAI pertama pada tingkat tersebut untuk kategori siber, satu tingkat di atas High milik GPT-5.6 Sol. OpenAI juga menyebutnya sebagai model paling selaras miliknya, dengan perilaku di luar sasaran yang diizinkan sebesar 0%, berbanding 48% untuk Sol. Ia menolak tugas siber tingkat lanjut seperti exploit proof-of-concept, dengan pengaman yang akan semakin longgar lewat OpenAI Daybreak.

Kemampuan siber

100% di ExploitBench berbanding 78.5% untuk GPT-5.6 Sol, 42.4% di ExploitGym berbanding 30.3%, serta 88.0% di SRE-Bench dalam satu percobaan (99.2% dalam empat percobaan), berbanding 55.9%/68.7%. Dua zero-day ditemukan selama evaluasi internal dan diungkapkan kepada para maintainer.

Rencana peluncuran bertahap

Organisasi terbatas hari ini, lalu semua pengguna ChatGPT Plus, Pro, Business, dan Enterprise; developer mendapatkannya melalui OpenAI API (model ID gpt-6-astra), Microsoft Azure, dan AWS Bedrock. Pemakaian sudah termasuk dalam kuota langganan yang ada, dengan kredit tambahan yang dapat dibeli; pengguna Pro, Business, dan Enterprise juga mendapatkan GPT-6 Astra Pro, dan admin Enterprise mengaktifkan Astra untuk workspace mereka, nonaktif secara default saat peluncuran. Fitur siber tingkat lanjut tetap dibatasi: konfigurasi produksi default dirilis tanpa kemampuan siber penuh, dengan OpenAI Daybreak memperluas akses dalam beberapa minggu ke depan.

Kendala yang diketahui

Pengguna ChatGPT dan Codex dapat melihat tindakan yang dijeda menunggu peninjauan, dan pekerjaan API bisa berhenti saat pemantauan penyalahgunaan menandainya. OpenAI juga menyoroti bahwa penalaran tertulis Astra menjadi lebih sulit dipantau dibandingkan GPT-5.6 Sol, dan menjadikan peningkatan kemampuan pemantauan sebagai prioritas riset. Pekerjaan pertahanan yang sah juga berisiko diperlambat.

Pertanyaan yang Sering Diajukan

GPT-6 Astra adalah model unggulan terbaru OpenAI, dirilis 3 September 2026 dan disebut oleh OpenAI sebagai model paling cerdas dan paling selaras di dunia. Model ini adalah yang pertama dinilai Critical pada kategori siber Preparedness Framework, mencetak 100% di ExploitBench dan 98% di FrontierMath Tier 4, berada pada titik jenuh ARC-AGI-3 dengan skor 99.9%, serta mencatatkan rekor penggunaan komputer terbaik di kelasnya.

Coba GPT-6 Astra di Felo

Model unggulan terbaru OpenAI sudah aktif: hasil benchmark, rekor penggunaan komputer dan pekerjaan profesional, pengaman, serta rencana peluncuran bertahap. Ganti Felo AI Search ke GPT-6 Astra dan tanyakan apa saja.

Coba Felo Astra Research

Dirilis 3 September 2026