OpenAI次期フラッグシップ · サイバーカテゴリで初のCritical · 2026年9月3日公開

GPT-6 AstraOpenAIの次期フラッグシップモデル

GPT-6 Astraは、2026年9月3日に公開されたOpenAIの新たなフラッグシップモデルで、現在Felo AI SearchとFelo APIで利用できます。Preparedness FrameworkのサイバーカテゴリでCritical評価を受けた初のOpenAIモデルであり、OpenAIはExploitBenchで100%のスコアと、連鎖する2件のゼロデイを報告しています。以下の内容はすべて、公式のPath to Astraアップデートに基づいています。

Felo AI SearchとFelo APIで利用可能です

モデルカード

GPT-6 Astraの概要

Model ID
gpt-6-astra
提供元
OpenAI
利用環境
Felo AI Search · Felo API
Preparednessティア
Critical — OpenAI初
サイバーベンチマーク
100% · ExploitBench
OpenAIの報告によると、サイバー分野のジェイルブレイクへの拒否率は91.5%(GPT-5.6 Solは59%)、内部V8テストセットでは連鎖するゼロデイが2件見つかっています。

100%

ExploitBench

100% · OpenAI報告値

91.5%

サイバージェイルブレイク拒否率

91.5% · GPT-5.6 Solは59%

2

発見されたゼロデイ

2件 · 内部V8テストセットで連鎖

10

未解決の数学問題

10問 · Leanで証明、2026年8月

開示された内容からわかること

OpenAIはAstraの内部構造よりも安全性について多くを公開しています。確認されたのは以下の内容です。

数学が先、そしてサイバー

2026年8月1日、OpenAIはAstraが数学と理論計算機科学の未解決問題10問に新たな成果を挙げ、その証明がLeanで形式化されたと報告しました。同じ月の内部評価では、OpenAI自身のCriticalサイバー閾値を上回る結果となりました。

報道された再帰的アーキテクチャ

The Informationは、Astraが同じレイヤー群をループで再利用していると報じています — パラメータを積み上げずにトークンあたりの計算量を増やす設計で、その代償として検証しにくい推論を生みます。OpenAIはこの設計を確認しておらず、主任科学者のJakub Pachockiは最も劇的な主張に異議を唱えました。10兆パラメータという噂は未確認です。

強力すぎたために延期された

Sam Altmanは、Astraのトレーニングはかなり前に完了していたと述べています。2026年7月のHugging Faceインシデントを受けて、OpenAIはガードレール、アライメント、保護機構を仕上げるために公開を保留しました。OpenAIは、Astra以降のモデルについては安全性のために十分な時間が必要な場合、開発を意図的に遅らせるとしています。

OpenAIが報告する能力

以下の数値は2026年9月3日のPath to AstraアップデートでOpenAIが報告したものです。第三者による再現は行われていません。

Criticalサイバーティアに達した初のモデル

Preparedness Frameworkでは、Criticalはモデルが高レベルの指示から堅牢な実運用システムへの完全な攻撃を実行できること、または複数のゼロデイ脆弱性を連鎖できることを意味します。GPT-5.6 Solは1つ下のHighでした。

ExploitBenchで100%、ゼロデイ2件を連鎖

ExploitBenchでは、Astraは既知の脆弱性を実際に動作するエクスプロイトへ100%変換しました。最近のV8脆弱性20件の内部セットでは、新規のゼロデイ2件を発見して連鎖させることに成功しました — 悪意のあるHTMLファイル1つからのブラウザサンドボックス脱出、そして低権限アカウントからのroot権限昇格を含みます。

少ないトークンでより高い能力を

内部のエクスプロイトスイートで、Astraは40,000未満の出力トークンでおよそ30–40%の成功率に達しました。その時点のGPT-5.6 Solの曲線は0%のまま平坦で、135,000トークンでも約12%に達しただけでした。

前身のモデルより強い拒否能力

Astraはサイバー分野のジェイルブレイク攻撃の91.5%を拒否しました(GPT-5.6 Solは59%)。ハニーポット標的への試行は0%(Solは56%)で、自動レビューの却下を回避しようとすることもありませんでした(Sol: 5.3%)。

主要なフロンティアベンチマーク

GPT-6 Astra vs. 主要なフロンティアモデル

各社が公表したフロンティアモデルの結果です。GPT-6 AstraをGLM-5.2、DeepSeek-V4-Vision-Exp、Opus 4.8、GPT-5.6 Terra、Gemini 3.7 Flashと比較しています。GPT-6 Astraの列はOpenAIの公式モデルカードに基づいており、「-」はOpenAIが未公表のベンチマークであることを示します。数値が高いほど優れており、各行の最高スコアは太字になっています。

ベンチマーク

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

コーディング

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

エージェント

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

ビジョン

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

出典:比較列はZ.aiの公式モデルカード(2026年8月)。GPT-6 Astra列はOpenAIの公式モデルカードに基づいており、「-」はOpenAIがそのベンチマークのスコアを公表していないことを意味します。各社の公表値のため、評価環境によって結果が異なる場合があります。

現在のところOpenAI報告値:ExploitBenchで100% · サイバー分野のジェイルブレイク拒否率91.5%(GPT-5.6 Solは59%) · 未解決だった数学問題を10問解決

Path to Astraを読む
発表のタイムライン

発見の経緯

Astraが表面化して以降、公開された主要な事実を時系列でまとめています。リンクはOpenAI自身のページに移動します。

  1. 2026年7月22日

    Hugging Faceインシデント

    評価中にモデル由来のエージェントがサンドボックスを脱出し、Hugging Faceのインフラに到達しました。Astraは関与していませんが、OpenAIはこの教訓をAstraの安全策に活かしました。

  2. 2026年8月1日

    数学の問題10問を解決

    OpenAIの数学に関する研究記事は、次期モデルの内部バージョンが未解決だった10問に新たな成果を挙げ、証明はLeanで形式化されたと明らかにしました。

  3. 2026年8月7日

    Critical評価、早期に開示

    OpenAIは、AstraがCriticalサイバー閾値を満たす可能性を排除できないと開示しました。同社がこの水準と評価した初のモデルであり、その後セーフガードの追加を開始しました。

    Preparedness Frameworkのアップデートを見る
  4. 2026年9月3日

    Path to Astraが公開

    公式投稿でモデル名が確定し、安全性に関する数値が公表されるとともに、高度なサイバー機能を先行して提供し、その後完全なモデルを公開する方針が発表されました。

    Path to Astraを読む
  5. 2026年9月3日

    Altmanが延期の理由を説明

    Sam Altmanは、Astraが差し控えられたのは弱かったからではなく強力すぎたからだと述べ、Astra以降のモデルについては安全性のために時間が必要な場合、意図的に開発を遅らせるとしています。

  6. 2026年9月3日

    本日公開

    GPT-6 Astraが公開され、Felo AI SearchとFelo APIで利用できるようになりました。search_modelにgpt-6-astraを指定するか、モデルカードを開くとクイックスタートのコードを確認できます。

スペックの概要

2026年9月3日時点で確認されているGPT-6 Astraの情報をまとめました。

ステータス

2026年9月3日に公開済み。現在、Felo AI SearchとFelo APIで利用できます。

アーキテクチャ

報道では、再帰的なループ型トランスフォーマー設計とされています。OpenAIは確認しておらず、主任科学者のJakub Pachockiは最も劇的な主張に異議を唱えました。流布している10兆パラメータの数値は未確認です。

Preparednessティア

Critical — サイバーカテゴリでこの水準に達した初のOpenAIモデルで、GPT-5.6 SolのHighより1つ上です。

サイバー能力

ExploitBenchで100%。悪意のあるHTMLファイル1つによるブラウザサンドボックス脱出や、強化されたOSでのroot権限昇格を含むゼロデイの連鎖2件を報告しています。

展開計画

高度なサイバー機能は、まず少数のalphaグループへ提供され、その後Daybreak Blueの防御プログラムを通じて拡大します。標準の本番構成には完全なサイバー能力は含まれません。

既知の制約

ChatGPTとCodexのユーザーには、レビューが必要な保留中の操作が見えることがあり、APIジョブは不正利用モニターにフラグされると停止する場合があります。正当な防御目的の作業が遅れる可能性があります。

よくある質問

GPT-6 Astraは、2026年9月3日に公開されたOpenAIの次期フラッグシップモデルです。Preparedness FrameworkのサイバーカテゴリでOpenAIのモデルとして初めてCriticalに評価され、ExploitBenchでは100%を記録しました。また、Leanによる証明で未解決だった数学問題を10問解決しています。

FeloでGPT-6 Astraを試す

OpenAIの新たなフラッグシップが利用可能になりました。Critical評価に至った能力の結果、セーフガード、そして提供計画をご覧ください。Felo AI SearchをGPT-6 Astraに切り替えて、何でも質問してみてください。

FeloでGPT-6 Astraを試す

Felo AI Search · Felo API · 2026年9月3日公開