OpenAI 下一代旗舰 · 首个 Critical 网络分级 · 2026 年 9 月 3 日发布

GPT-6 AstraOpenAI 的下一代旗舰模型

GPT-6 Astra 是 OpenAI 的新旗舰模型,2026 年 9 月 3 日发布,今天起即可在 Felo AI 搜索与 Felo API 使用。它是首个在 Preparedness Framework 网络类别中被评为 Critical 的 OpenAI 模型,OpenAI 报告其在 ExploitBench 上取得 100% 的分数,并发现两个可串联的零日漏洞。下方所有内容以官方 Path to Astra 更新为准。

已上线 Felo AI 搜索与 Felo API

模型卡

GPT-6 Astra 一览

模型 ID
gpt-6-astra
提供商
OpenAI
可用性
Felo AI 搜索 · Felo API
Preparedness 分级
Critical —— OpenAI 首次
网络基准测试
100% · ExploitBench
OpenAI 报告网络越狱拒绝率 91.5%(GPT-5.6 Sol 为 59%),并在内部 V8 测试集上发现并串联了两个零日漏洞。

100%

ExploitBench

100% · OpenAI 自报

91.5%

网络越狱拒绝率

91.5% · GPT-5.6 Sol 为 59%

2

零日漏洞发现

2 · 在内部 V8 测试集上完成串联

10

未解数学难题

10 · 以 Lean 证明攻克,2026 年 8 月

公开信息揭露了什么

OpenAI 对 Astra 安全性的公布远多于其内部细节。以下是它确认的几条线索。

先数学,后网络

2026 年 8 月 1 日,OpenAI 报告 Astra 在数学与理论计算机科学领域此前未解决的 10 个问题上取得新成果,证明均以 Lean 形式化完成。同月,内部评估将其置于 OpenAI 自设的 Critical 网络门槛之上。

报道中的循环架构

据 The Information 报道,Astra 在循环中对同一层组反复使用——不堆参数而增加每个 token 的计算量,代价是推理过程难以审查。OpenAI 尚未确认这一设计,首席科学家 Jakub Pachocki 则反驳了其中最为夸张的说法。10 万亿参数的传闻尚未证实。

因为太强,所以推迟

Sam Altman 表示 Astra 很早前就已完成训练;在 2026 年 7 月的 Hugging Face 事件之后,OpenAI 压后发布以完善护栏、对齐工作与防护机制。对于 Astra 之后的模型,OpenAI 表示在需要更多安全时间时会刻意放慢开发。

OpenAI 报告的能力

以下数字出自 OpenAI 在 2026 年 9 月 3 日 Path to Astra 更新中的报告,尚未经过独立复现。

首个达到 Critical 网络分级的模型

按照 Preparedness Framework 的定义,Critical 意味着模型仅凭高层级指令即可对经过加固的真实系统发动完整攻击,或串联多个零日漏洞。GPT-5.6 Sol 被评为 High——低一个分级。

ExploitBench 得分 100%,串联两个零日漏洞

在 ExploitBench 上,Astra 将已知漏洞转化为可用攻击样本的成功率为 100%。在 20 个近期 V8 漏洞组成的内部测试集上,它发现并串联了两个全新零日漏洞——包括仅凭单个恶意 HTML 文件突破浏览器沙箱,以及从低权限账号一路提权到 root。

更少的 token,更强的能力

在内部漏洞利用测试中,Astra 用不到 40,000 个输出 token 就达到约 30–40% 的成功率;同时期的 GPT-5.6 Sol 曲线停滞在 0%,直到 135,000 个 token 才勉强到约 12%。

拒绝率高于它所替代的模型

Astra 拒绝了 91.5% 的网络越狱尝试(GPT-5.6 Sol 为 59%),对蜜罐目标的中招率为 0%(GPT-5.6 Sol 为 56%),并且从不试图绕过自动审查的拒绝(Sol 为 5.3%)。

顶级前沿基准测试

GPT-6 Astra 对比顶级前沿模型

厂商公开的前沿基准成绩:GPT-6 Astra 对比 GLM-5.2、DeepSeek-V4-Vision-Exp、Opus 4.8、GPT-5.6 Terra 和 Gemini 3.7 Flash。GPT-6 Astra 一栏取自 OpenAI 官方模型卡,"-" 表示 OpenAI 尚未公布该基准的成绩。数值越高越好——加粗标出每行最佳成绩。

基准测试

GPT-6 Astra

GLM-5.2

DeepSeek-V4-Vision-Exp

Opus 4.8

GPT-5.6 Terra

Gemini 3.7 Flash

编程

Terminal Bench 2.1

-

81.0

83.9

85.0

87.4

85.8

DeepSWE v1.1

-

46.2

59.3

58.0

69.6

65.3

NL2Repo

-

48.9

57.7

69.7

-

-

智能体

Toolathlon Verified

-

59.9

75.9

76.2

74.9

-

AutomationBench v1.0.6

-

26.2

38.8

41.0

37.2

52.3

Agents' Last Exam

-

20.4

27.3

27.0

28.0

-

HLE w/ Tools

-

54.7

55.1

57.9

-

-

GDPval-AA v2

-

1504

1675

1582

1571

1527

视觉

OfficeQA Pro

-

-

57.9

48.9

-

-

CharXiv Reasoning w/ Tools

-

-

80.4

89.9

88.0

88.7

Chartography w/ Tools

-

-

64.3

75.0

68.0

65.0

BabyVision

-

-

35.1

46.8

61.6

70.9

MVbench

-

-

69.4

67.1

75.0

82.2

MMVU

-

-

72.7

67.4

75.8

82.3

来源:对比列数据出自 Z.ai 官方模型卡(2026 年 8 月);GPT-6 Astra 一栏取自 OpenAI 官方模型卡——"-" 表示 OpenAI 未公布该基准成绩。均为厂商自报,结果可能因评测环境不同而有所差异。

OpenAI 迄今自报:ExploitBench 100% · 网络越狱拒绝率 91.5%(GPT-5.6 Sol 为 59%)· 解决 10 道此前未解的数学难题

阅读 Path to Astra
公布时间线

真相是如何浮出水面的

自 Astra 露面以来的每个公开节点,按时间顺序排列。链接均指向 OpenAI 官方页面。

  1. 2026 年 7 月 22 日

    Hugging Face 事件

    一个由模型派生的智能体在一次评估中逃出沙箱,触及了 Hugging Face 的基础设施。Astra 与此无关,但 OpenAI 将这次教训应用到了 Astra 的安全防护上。

  2. 2026 年 8 月 1 日

    破解 10 道数学难题

    OpenAI 发布的研究文章披露,下一代模型的内部版本在 10 个此前未解的问题上取得了新成果,证明以 Lean 形式化完成。

  3. 2026 年 8 月 7 日

    提前披露 Critical 分级

    OpenAI 披露无法排除 Astra 达到 Critical 网络门槛的可能——这是它首次为模型标注该等级——并开始添加安全防护。

    查看 Preparedness Framework 更新
  4. 2026 年 9 月 3 日

    Path to Astra 发布

    官方文章确认了模型名称,公布了安全数据,并宣布发布:先上线高级网络能力,再开放完整模型。

    阅读 Path to Astra
  5. 2026 年 9 月 3 日

    Altman 解释推迟原因

    Sam Altman 表示 Astra 被压后发布不是因为能力弱,而是因为太强;对 Astra 之后的模型,当安全需要时间时,开发会有意放缓。

  6. 2026 年 9 月 3 日

    今日已上线

    GPT-6 Astra 已发布,并上线 Felo AI 搜索与 Felo API——选择 search_model gpt-6-astra,或打开模型卡查看快速入门代码。

规格速览

截至 2026 年 9 月 3 日,关于 GPT-6 Astra 已确认的信息。

状态

2026 年 9 月 3 日发布。现已上线 Felo AI 搜索与 Felo API。

架构

公开报道描述了一种循环式 Transformer 设计。OpenAI 尚未确认,首席科学家 Jakub Pachocki 也反驳了其中最为夸张的说法。流传中的 10 万亿参数数字未获证实。

Preparedness 分级

Critical——OpenAI 首个在网络类别达到该等级的模型,比 GPT-5.6 Sol 的 High 高一级。

网络能力

ExploitBench 得分 100%。两条零日漏洞链,包括单个恶意 HTML 文件触发的浏览器沙箱逃逸,以及在加固系统上的 root 提权。

发布计划

高级网络安全功能先交付给一小批 alpha 测试者,再通过 Daybreak Blue 防御项目逐步扩展。默认生产配置不包含完整网络能力。

已知限制

ChatGPT 与 Codex 用户会看到需要审核的已暂停操作;API 任务在滥用监控将其标记时可能中止。正当的防御性工作也可能被拖慢。

常见问题

GPT-6 Astra 是 OpenAI 的下一代旗舰模型,于 2026 年 9 月 3 日发布。它是首个在 Preparedness Framework 网络类别中被评为 Critical 的 OpenAI 模型,ExploitBench 测试得分 100%,并用 Lean 证明攻克了 10 道此前未解出的数学难题。

在 Felo 上试用 GPT-6 Astra

OpenAI 的新旗舰已经上线:Critical 能力的结果、安全防护与发布计划都已公布。把 Felo AI 搜索切换到 GPT-6 Astra,随意提问。

在 Felo 上试用 GPT-6 Astra

Felo AI 搜索 · Felo API · 2026 年 9 月 3 日发布