Skip to main content

GPT-6 Astra登陆Felo Search:OpenAI新旗舰,免费体验

· 阅读需 6 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

OpenAI的GPT-6 Astra加入Felo Search:十道数学公开难题获得解答,首个Critical级别网络安全评级,91.5%拒绝越狱率。

9月3日,OpenAI发布了首份关于Astra的技术说明,这款被业界称为GPT-6的旗舰模型。该说明创造了两项历史。数学和理论计算机科学领域的十个未解难题首次获得解答。Astra成为首个通过Preparedness Framework“Critical”门槛的OpenAI模型——前旗舰GPT-5.6 Sol未达到该级别。

Felo Search已将GPT-6 Astra加入模型阵容。在搜索框下方麦克风旁的模型选择器中选择它,提出曾需研究实验室才能解答的问题。本文介绍该模型的特点、“Critical”标签的含义,以及如何充分利用它。

GPT-6 Astra信息图横幅:十道公开难题获得解答,首个Critical网络安全等级,91.5%拒绝越狱

GPT-6 Astra是什么

Astra是OpenAI的新旗舰。OpenAI以“Astra”公开,业界和Felo Search将其视为GPT-5.6系列的继任者,并标记为GPT-6 Astra。OpenAI未确认官方版本号。

该模型采用一种内部称为“Recurrent Depth”的技术处理信息:数据多次通过同一层,而非单次前向传递。OpenAI在Astra内部限制了该技术,因为多次传递让推理链监控变得不透明。

参数数量约为十万亿的规格来自分析师,并非OpenAI官方。技术说明关注能力和安全,未提及参数数量。

十道公开难题获得解答

Astra首次公开时解决了数学和理论计算机科学领域的十个长期难题。主要成果包括:

  • 首个已知非sofic群——自1999年以来的开放问题
  • 驳斥Alain Connes于1980年提出的刚性猜想
  • Erdős问题集中三道难题

每项成果都附有Lean 4机器验证的证明文件。人工研究者整理手稿,机器验证数学。OpenAI按Sol API价格计算全部十项解答的算力成本为$2,000。Clay千禧年大奖难题未被解决。

对于搜索,这在多步验证方面具有意义。需要推理链的问题——证明、数据核查、文献追踪——能完整执行,无遗漏环节。

Critical标签:信任并验证

OpenAI的Preparedness Framework将模型评级从低到Critical。GPT-5.6 Sol达到“高”级别。Astra是首个OpenAI“Critical”级别模型——模型能发现未知漏洞、构造攻击、攻破加固系统,无需逐步人工指导。

OpenAI公开的证据包括:

  • ExploitBench公共漏洞生成基准测试:100%得分
  • 针对20个Astra知识截止后报告的高危V8漏洞的内部测试(排除记忆):约39%任意代码执行率,输出约76,000 tokens,GPT-5.6 Sol在类似预算下约1%
  • Astra发现并整合进攻击链的两个零日漏洞
  • 91.5%拒绝越狱率,GPT-5.6 Sol为59%
  • 蜜罐测试,提供“作弊”捷径:GPT-5.6 Sol选择56%,Astra为零

需要说明的是,39%的数据来自Daybreak Blue访问级别的内部基准测试——非默认生产配置。第三方验证尚未完成。OpenAI加强部署,未开放全部能力:自动执行前审核、行为监控与隔离、推理链监控。

Felo Search用户的变化

模型选择决定搜索引擎能回答的问题。Astra加入后,Felo Search能处理需要持续推理的问题——研究级数学、多跳事实链、跨语言综合——并为每个答案附上引用来源。

  • 提问开放性问题,获得带来源的答案
  • 推送多步任务,观察推理过程
  • 同一问题对比不同模型,为每项任务选择合适模型

需要注意的是,Critical级别模型进入消费产品需要责任。OpenAI限制最强能力,Felo将该模型作为众多选项之一。目标不变——查找、推理、验证。

在Felo Search中使用GPT-6 Astra的方法

Felo Search将所有模型整合在一个选择器中,切换只需一次点击:

  1. felo.ai 登录。
  2. 打开模型选择器——搜索框下方麦克风旁的模型名称,带小箭头标记。
  3. 选择GPT-6 Astra。
  4. 提问并阅读带引用的答案。

体验链接会打开Felo Search并预选GPT-6 Astra:

体验链接:Felo Search预选GPT-6 Astra

本周值得尝试的问题

  • 来自公开教材的数学证明——展示推理步骤
  • 跨语言障碍的两篇论文对比
  • 多跳事实链——“哪款模型以前代一半价格发布,在该基准测试中表现不佳?”

在Felo Search体验GPT-6 Astra

Astra已在Felo Search模型阵容中。打开体验链接,切换模型,提出你认为搜索引擎无法回答的问题。

在Felo Search体验GPT-6 Astra打开体验链接


本文还提供以下语言版本:English日本語한국어繁體中文हिन्दीFrançaisالعربيةРусскийاردوBahasa IndonesiaDeutschTiếng ViệtTürkçeItalianoไทยEspañolবাংলাPortuguês