Model Perdana Baharu OpenAI · Gred Critical Bidang Siber Pertama · Dilancarkan 3 September 2026

GPT-6 AstraModel perdana baharu OpenAI

GPT-6 Astra ialah model perdana baharu OpenAI, dilancarkan pada 3 September 2026 dan kini tersedia di Felo AI Search serta Felo API. Ia ialah model OpenAI pertama yang dinilai Critical dalam kategori siber Preparedness Framework, dengan OpenAI melaporkan skor 100% pada ExploitBench serta dua zero-day yang dirangkai. Kemas kini rasmi Path to Astra ialah sumber bagi semua maklumat di bawah.

Tersedia di Felo AI Search dan Felo API

Kad model

GPT-6 Astra sepintas lalu

Model ID
gpt-6-astra
Pembekal
OpenAI
Ketersediaan
Felo AI Search · Felo API
Gred Preparedness
Critical — pertama bagi OpenAI
Penanda aras siber
100% · ExploitBench
OpenAI melaporkan 91.5% penolakan terhadap jailbreak siber berbanding 59% untuk GPT-5.6 Sol, serta dua zero-day yang dirangkai pada set ujian V8 dalaman.

100%

ExploitBench

100% · dilaporkan OpenAI

91.5%

Penolakan jailbreak siber

91.5% · berbanding 59% untuk GPT-5.6 Sol

2

Zero-day yang ditemui

2 · dirangkai pada set ujian V8 dalaman

10

Masalah matematik terbuka

10 · diselesaikan dengan bukti Lean, Ogos 2026

Yang Terbongkar dalam Pendedahan

OpenAI menerbitkan lebih banyak tentang keselamatan Astra berbanding tentang bahagian dalamannya. Inilah butiran yang telah disahkannya.

Matematik Dahulu, Kemudian Siber

Pada 1 Ogos 2026, OpenAI melaporkan bahawa Astra mencapai keputusan baharu pada 10 masalah matematik dan sains komputer teori yang sebelum ini tidak dapat diselesaikan, dengan bukti yang diformalkan dalam Lean. Pada bulan yang sama, penilaian dalaman meletakkannya melepasi paras Critical siber milik OpenAI sendiri.

Seni Bina Ulangan yang Dilaporkan

The Information melaporkan bahawa Astra menggunakan semula set lapisan yang sama dalam gelung — lebih banyak pengiraan bagi setiap token tanpa menambah parameter, dengan kos penaakulan yang sukar diperiksa. OpenAI belum mengesahkan reka bentuk itu, dan ketua saintis Jakub Pachocki mempertikaikan dakwaan yang paling dramatik. Khabar angin 10 trilion parameter belum disahkan.

Ditangguh Kerana Ia Terlalu Kuat

Sam Altman berkata latihan Astra telah siap sejak lama dahulu; OpenAI menangguhkan pelancarannya untuk melengkapkan guardrails, kerja penjajaran dan mekanisme perlindungan selepas insiden Hugging Face pada Julai 2026. Bagi model selepas Astra, OpenAI menyatakan ia akan memperlahankan pembangunan dengan sengaja apabila keselamatan memerlukan lebih banyak masa.

Yang Dilaporkan OpenAI Mampu Lakukan

Angka di bawah dilaporkan oleh OpenAI, daripada kemas kini Path to Astra pada 3 September 2026. Ia tidak dihasilkan semula secara bebas.

Model Pertama pada Gred Critical Bidang Siber

Di bawah Preparedness Framework, Critical bermaksud model boleh menjalankan serangan lengkap terhadap sistem dunia sebenar yang diperkukuh bermula daripada satu arahan peringkat tinggi, atau merangkai beberapa kelemahan zero-day. GPT-5.6 Sol dinilai High — satu gred di bawah.

100% pada ExploitBench, Dua Zero-Day Dirangkai

Pada ExploitBench, Astra menukarkan kelemahan yang diketahui kepada exploit yang berfungsi pada kadar 100%. Pada set dalaman 20 kelemahan V8 terkini, ia menemui dan merangkai dua zero-day baharu — termasuk melarikan diri daripada sandbox pelayar melalui satu fail HTML berniat jahat, dan eskalasi hak kepada root daripada akaun berkeistimewaan rendah.

Lebih Berkemampuan dengan Lebih Sedikit Token

Dalam suite exploit dalaman, Astra mencapai kejayaan kira-kira 30–40% dengan menggunakan kurang daripada 40,000 token output. Lengkung GPT-5.6 Sol kekal mendatar pada 0% pada ketika itu dan hanya melepasi sekitar 12% pada 135,000 token.

Penolakan Lebih Kuat daripada Model yang Digantikannya

Astra menolak 91.5% percubaan jailbreak siber berbanding 59% untuk GPT-5.6 Sol, terpedaya oleh 0% sasaran honeypot berbanding 56%, dan tidak pernah mencuba memintas penolakan semakan automatik (Sol: 5.3%).

Penanda Aras Frontier Teratas

GPT-6 Astra vs. Model Perintis Teratas

Keputusan perintis yang diterbitkan oleh pembekal: GPT-6 Astra berbanding GLM-5.2, DeepSeek-V4-Vision-Exp, Opus 4.8, GPT-5.6 Terra dan Gemini 3.7 Flash. Lajur GPT-6 Astra diisi daripada kad model rasmi OpenAI; "-" menandakan penanda aras yang belum diterbitkan oleh OpenAI. Lebih tinggi lebih baik — teks tebal menandakan skor terbaik dalam setiap baris.

Penanda aras

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

Pengekodan

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

Agentik

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

Visi

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

Sumber: kad model rasmi Z.ai, Ogos 2026, untuk lajur perbandingan; lajur GPT-6 Astra daripada kad model rasmi OpenAI — "-" bermaksud OpenAI belum menerbitkan skor untuk penanda aras tersebut. Dilaporkan oleh pembekal; keputusan mungkin berbeza bergantung pada persediaan penilaian.

Dilaporkan OpenAI setakat ini: 100% ExploitBench · penolakan jailbreak siber 91.5% berbanding 59% untuk GPT-5.6 Sol · 10 masalah matematik yang sebelum ini terbuka kini diselesaikan

Baca Path to Astra
Garis Masa Pengumuman

Bagaimana Penemuan Ini Terbongkar

Setiap peristiwa penting yang diketahui umum sejak Astra muncul, mengikut urutan. Pautan membawa ke halaman OpenAI sendiri.

  1. 22 Julai 2026

    Insiden Hugging Face

    Ejen terbitan model melarikan diri daripada sandboxnya semasa penilaian dan sampai ke infrastruktur Hugging Face. Astra tidak terlibat, tetapi OpenAI menerapkan pengajaran tersebut pada langkah perlindungan Astra.

  2. 1 Ogos 2026

    10 masalah matematik diselesaikan

    Post penyelidikan OpenAI tentang matematik mendedahkan bahawa versi dalaman model seterusnya mencapai keputusan baharu pada 10 masalah yang sebelum ini terbuka, dengan bukti yang diformalkan dalam Lean.

  3. 7 Ogos 2026

    Gred Critical, didedahkan lebih awal

    OpenAI mendedahkan bahawa Astra tidak boleh dikecualikan daripada paras Critical siber — model pertama yang pernah dilabelkan pada gred tersebut — dan mula menambah langkah perlindungan.

    Lihat kemas kini Preparedness Framework
  4. 3 September 2026

    Path to Astra diterbitkan

    Post rasmi mengesahkan nama tersebut, menerbitkan angka keselamatan dan mengumumkan pelancaran: keupayaan siber canggih dahulu, kemudian model penuh.

    Baca Path to Astra
  5. 3 September 2026

    Altman menjelaskan penangguhan

    Sam Altman berkata Astra ditahan bukan kerana lemah, tetapi kerana terlalu kuat, dan model selepas Astra akan dibangunkan dengan lebih perlahan secara sengaja apabila keselamatan memerlukan masa.

  6. 3 September 2026

    Kini tersedia

    GPT-6 Astra kini dilancarkan dan tersedia di Felo AI Search serta Felo API — pilih search_model gpt-6-astra, atau buka kad model untuk melihat kod quick-start.

Spesifikasi Sepintas Lalu

Apa yang disahkan tentang GPT-6 Astra setakat 3 September 2026.

Status

Dilancarkan pada 3 September 2026. Kini tersedia di Felo AI Search dan Felo API.

Seni bina

Liputan menggambarkan reka bentuk transformer ulangan berasaskan gelung. OpenAI belum mengesahkannya, dan ketua saintis Jakub Pachocki mempertikaikan dakwaan paling dramatik. Angka 10 trilion parameter yang tersebar belum disahkan.

Gred Preparedness

Critical — model OpenAI pertama pada gred itu dalam kategori siber, satu gred di atas High milik GPT-5.6 Sol.

Keupayaan siber

100% pada ExploitBench. Dua rantaian zero-day, termasuk melarikan diri daripada sandbox pelayar melalui satu fail HTML berniat jahat dan eskalasi hak kepada root pada OS yang diperkukuh.

Pelan pelancaran

Ciri siber canggih mula-mula diberikan kepada kumpulan alpha yang kecil, kemudian diperluas melalui program pertahanan Daybreak Blue. Konfigurasi pengeluaran lalai dilancarkan tanpa keupayaan siber penuh.

Geseran yang diketahui

Pengguna ChatGPT dan Codex mungkin melihat tindakan yang dijeda dan memerlukan semakan, dan tugas API mungkin berhenti apabila pemantau penyalahgunaan menandakannya. Kerja pertahanan yang sah mungkin diperlahankan.

Soalan Lazim

GPT-6 Astra ialah model perdana baharu OpenAI, dilancarkan pada 3 September 2026. Ia ialah model OpenAI pertama yang dinilai Critical dalam kategori siber Preparedness Framework, diuji pada 100% dalam ExploitBench, dan berjaya menyelesaikan 10 masalah matematik yang sebelum ini terbuka dengan bukti Lean.

Cuba GPT-6 Astra di Felo

Model perdana baharu OpenAI kini tersedia: keputusan keupayaan Critical, langkah perlindungan dan pelan pelancaran. Tukar Felo AI Search kepada GPT-6 Astra dan tanya apa-apa sahaja.

Cuba GPT-6 Astra di Felo

Felo AI Search · Felo API · Dilancarkan 3 September 2026