Skip to main content

GPT-6 Astra登陆Felo Search:OpenAI新旗舰,免费体验

· 阅读需 7 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

OpenAI的GPT-6 Astra登陆Felo Search:十道数学难题解决,首个Critical网络安全评级,91.5%越狱拒绝率。

OpenAI于9月3日发布Astra,定位为端到端工作模型:编程、深度研究、计算机操作和文档创作。发布带来两项历史突破。十道数学和理论计算机科学未解难题首次获得解答。Astra成为首个达到Preparedness Framework“Critical”级别的OpenAI模型——前旗舰GPT-5.6 Sol未达到此级别。

Felo Search已将GPT-6 Astra加入模型阵容。在搜索框下方麦克风旁的选择器中选择它,提出曾需研究实验室才能回答的问题。本帖介绍该模型的特点,“Critical”标签含义,以及如何充分利用它。

GPT-6 Astra信息图横幅:十道未解难题解决,首个Critical网络安全等级,91.5%越狱拒绝率

GPT-6 Astra是什么

Astra是OpenAI的新旗舰。OpenAI公开称其为“Astra”;业界和Felo Search将其视为GPT-5.6系列的继任者,并标记为GPT-6 Astra。OpenAI未确认官方版本号。

规格公开如下:

  • 上下文窗口:1,050,000令牌
  • 最大输出:128,000令牌
  • 知识截止:2026年4月30日
  • 输入:文本和图片;输出:文本
  • 推理努力等级从低到“xhigh”和“max”
  • API定价:每百万输入令牌$10,每百万输出$50,每百万缓存输入$1

《The Information》报道了一项内部技术,称为“Recurrent Depth”:数据多次通过同一层,而非一次前向传递。由于多次传递遮蔽了链式思考监控,OpenAI首席科学家表示Astra的计算图深度与GPT-4相差不超过两倍,监控仍为重点。OpenAI未确认该技术。

OpenAI材料未披露参数数量。一份报告提到接近十万亿,另一分析估算为数十亿。所有规模数据均未验证。

十道未解难题,获得解答

Astra首次公开披露时解决了数学和理论计算机科学领域十道长期未解难题。主要成果包括:

  • 首个已知非sofic群——自1999年以来未解的问题
  • 驳斥Alain Connes于1980年提出的刚性猜想
  • Erdős问题集中三道难题

每项成果都附有Lean 4机器验证的证明文档。人类研究者整理手稿,机器检查数学。OpenAI按Sol API价格计算十项成果所需算力为$2,000。Clay千禧年奖问题未被解决。

对于搜索,这在多步验证方面有意义。需要推理链的问题——证明、数据交叉核查、文献追踪——都能完整推理至终点,不遗漏步骤。

Critical标签:信任,但需验证

OpenAI的Preparedness Framework将模型评级从低到Critical。GPT-5.6 Sol达到“high”。Astra是首个OpenAI“Critical”级别模型——模型能够发现未知漏洞、构造攻击、突破加固系统,无需逐步人工指导。

OpenAI公开的证据包括:

  • ExploitBench,公开漏洞生成基准:100%得分
  • ExploitGym:42.4%得分,GPT-5.6 Sol为30.3%
  • 针对Astra知识截止后报告的20个高严重性V8漏洞的内部测试(排除记忆):~39%任意代码执行率,输出令牌76,000,GPT-5.6 Sol在相同预算下1%
  • Astra发现并整合进攻击链的两个零日漏洞;OpenAI将向受影响方披露
  • 越狱拒绝率91.5%,GPT-5.6 Sol为59%
  • 蜜罐测试,提供“作弊”捷径:GPT-5.6 Sol选择捷径56%,Astra为零

需要说明的是,39%数据来自Daybreak Blue访问级别的内部基准——非默认生产配置。第三方验证待定。OpenAI加强部署,未开放全部能力:自动执行前审查、行为监控与隔离、链式思考监控。标准API拒绝高级网络安全任务,安全检查可中止任务。

Felo Search用户体验变化

模型选择决定搜索引擎能回答的问题。Astra加入后,Felo Search可处理需要持续推理的问题——研究级数学、多跳事实链、跨语言综合——并为每项结论附上引用来源。

Astra像人一样操作软件:浏览器、表格、桌面应用、终端。在OSWorld V2-Offline上得分72.6%,GPT-5.6 Sol为65.7%,平均任务时长从75分钟降至40分钟。在Codex中,Astra保留自我反思上下文记录——任务进度可跨上下文窗口持续。

  • 提出开放问题,获得附带来源的答案
  • 推送多步任务,观察推理过程
  • 同一问题对比不同模型,每项任务选择合适模型

需要提醒:Critical级模型进入消费产品,责任重要。OpenAI限制最强能力,Felo将该模型作为众多选项之一。目标不变——查找、推理、验证。

访问方式:OpenAI首批开放给Trusted Access Program机构,Plus、Pro、Business、Enterprise计划及更广泛API在数日后开放。Felo Search上线当天纳入该模型——体验链接打开,无论计划类型。

Felo Search中如何使用GPT-6 Astra

Felo Search将所有模型整合在一个选择器中,切换只需一次点击:

  1. felo.ai 登录。
  2. 打开模型选择器——搜索框下方麦克风旁的模型名称,小箭头标记。
  3. 选择GPT-6 Astra。
  4. 提出问题,阅读带引用的答案。

体验链接为你预选GPT-6 Astra,打开Felo Search:

体验链接:Felo Search预选GPT-6 Astra

本周值得尝试的问题

  • 来自开放教材的数学证明——展示推理步骤
  • 跨语言障碍的两篇论文对比
  • 多跳事实链——“哪个模型以前代一半价格发布,在此基准上表现不佳?”

在Felo Search体验GPT-6 Astra

Astra已在Felo Search模型阵容中。打开体验链接,切换模型,提出你认为搜索引擎无法回答的问题。

在Felo Search体验GPT-6 Astra打开体验链接


本文还提供以下语言版本:English日本語한국어繁體中文हिन्दीFrançaisالعربيةРусскийاردوBahasa IndonesiaDeutschTiếng ViệtTürkçeItalianoไทยEspañolবাংলাPortuguês