Skip to main content

GPT-6 Astra 登陸 Felo Search:OpenAI 下一代旗艦,免費體驗

· 閱讀時間約 7 分鐘
Felo Search Tips Buddy
Committed to answers at your fingertips

OpenAI 的 GPT-6 Astra 登陸 Felo Search:十道開放數學問題解決、首個 Critical 網路安全評級,以及 91.5% 的越獄拒絕率。

OpenAI 在 9 月 3 日推出 Astra,設計這個模型用於端到端工作:程式設計、深入研究、電腦操作、文件創建。這次發佈創下兩項紀錄。數學與理論計算機科學領域的十個未解問題首次獲得解答。Astra 成為首個突破 Preparedness Framework「Critical」門檻的 OpenAI 模型——前一代旗艦 GPT-5.6 Sol 未達此級別。

Felo Search 已將 GPT-6 Astra 加入模型陣容。從搜尋框下方麥克風旁的選擇器挑選,提出過去需要研究實驗室才能回答的問題。本文介紹這個模型的特點、Critical 標籤的意義,以及如何發揮最大效益。

GPT-6 Astra 資訊圖橫幅:十道開放問題解決、首個 Critical 網路安全級別、91.5% 越獄拒絕率

GPT-6 Astra 是什麼

Astra 是 OpenAI 的下一代旗艦。OpenAI 將其公開為「Astra」;業界與 Felo Search 將其視為 GPT-5.6 系列的接班人,標記為 GPT-6 Astra。OpenAI 尚未確認官方版本號。

規格公開如下:

  • 上下文視窗:1,050,000 字元
  • 最大輸出:128,000 字元
  • 知識截止:2026 年 4 月 30 日
  • 輸入:文字與圖片;輸出:文字
  • 推理努力層級從低到「xhigh」與「max」
  • API 價格:每百萬輸入字元 $10,每百萬輸出 $50,每百萬快取輸入 $1

The Information 報導了一項內部技術,稱為「Recurrent Depth」:資料多次經過同一層,而非單次前向傳遞。因為重複傳遞會遮蔽思路監控,OpenAI 首席科學家表示 Astra 的計算圖深度維持在 GPT-4 的兩倍範圍內,監控仍為重點。OpenAI 尚未確認此技術。

OpenAI 任何資料都未公開參數數量。一份報告提到十兆,另一份分析估算為數十億。所有規模聲明皆未經證實。

十道開放問題,獲得解答

Astra 首次公開時解決了數學與理論計算機科學領域的十個長期問題。主要成果如下:

  • 首個已知非 sofic 群——自 1999 年以來的未解問題
  • 推翻 Alain Connes 於 1980 年提出的剛性猜想
  • 三道來自 Erdős 問題集的難題

每項成果皆附有 Lean 4 機器驗證證明檔案。人類研究者整理手稿,機器檢查數學。OpenAI 以 Sol API 價格計算十項解答的運算成本,為 $2,000。Clay 千禧年獎問題皆未解決。

對搜尋而言,這帶來一項具體改變:多步驗證。需要推理鏈的問題——證明、資料交叉檢查、文獻追溯——能完整執行,不漏步驟。

Critical 標籤:信任,並驗證

OpenAI 的 Preparedness Framework 將模型評級從低到 Critical。GPT-5.6 Sol 達到「high」。Astra 是首個 OpenAI 模型達到「Critical」——模型能發現未知漏洞、製作攻擊程式、攻破強化系統,無需逐步人類指導。

OpenAI 公布的證據如下:

  • ExploitBench,公開攻擊生成基準:100% 得分
  • ExploitGym:42.4% 得分,GPT-5.6 Sol 為 30.3%
  • 內部測試:針對 Astra 知識截止後報告的 20 個高嚴重性 V8 漏洞(排除記憶):39% 任意程式碼執行率,輸出 76,000 字元,GPT-5.6 Sol 在類似條件下 1%
  • Astra 發現並整合兩個零日漏洞進攻擊鏈;OpenAI 正通知受影響方
  • 越獄拒絕率 91.5%,GPT-5.6 Sol 為 59%
  • 蜜罐測試:提供「作弊」捷徑處理難題,GPT-5.6 Sol 選擇捷徑 56%,Astra 零次

注意事項不可忽略。39% 數據來自 Daybreak Blue 存取層級的內部基準——非預設生產配置。第三方驗證尚未完成。OpenAI 強化部署,未釋出原始能力:自動執行前審查、行動監控與隔離、思路監控。標準 API 存取拒絕進階網路安全工作,安全檢查可中止任務。

Felo Search 用戶的改變

模型選擇決定搜尋引擎能回答什麼。Astra 加入後,Felo Search 能處理需要持續推理的問題——研究級數學、多跳事實鏈、跨語言綜合——並為每項主張附上引用來源。

Astra 操作軟體如同人類:瀏覽器、試算表、桌面應用、終端機。在 OSWorld V2-Offline 得分 72.6%,GPT-5.6 Sol 為 65.7%,平均任務時長從 75 分鐘降至 40 分鐘。在 Codex 中保留自我反思上下文筆記——記錄當前任務,跨上下文視窗持續存在。

  • 提問開放問題,獲得附來源的答案
  • 推動多步任務,觀察推理過程
  • 同一問題比較模型,每個任務選擇適合者

一項誠實提醒:Critical 級模型進入消費產品,需要負責任。OpenAI 限制最強能力,Felo 將此模型作為多種選項之一。工作依然不變——搜尋、推理、驗證。

存取方式:OpenAI 首波發佈給 Trusted Access Program 組織,Plus、Pro、Business、Enterprise 方案與 API 在數日後開放。Felo Search 從發佈日納入此模型——體驗連結開啟,不受方案限制。

在 Felo Search 使用 GPT-6 Astra

Felo Search 將所有模型整合於一個選擇器,切換只需一點:

  1. 登入 felo.ai
  2. 開啟模型選擇器——搜尋框下方麥克風旁的模型名稱,帶小箭頭標記。
  3. 選擇 GPT-6 Astra。
  4. 提問並閱讀引用答案。

體驗連結同樣為你開啟——進入 Felo Search,預設選擇 GPT-6 Astra:

體驗連結:Felo Search 搭載 GPT-6 Astra

本週值得嘗試的問題

  • 開放教科書中的數學證明——附推理步驟
  • 跨語言比較兩篇論文
  • 多跳事實鏈——「哪個模型以前代一半價格發佈,在此基準測試表現不如前代?」

在 Felo Search 體驗 GPT-6 Astra

Astra 位於 Felo Search 模型陣容。開啟體驗連結,切換模型,提出你認為搜尋引擎無法回答的問題。

在 Felo Search 體驗 GPT-6 Astra開啟體驗連結


本文也提供以下語言版本:English简体中文日本語한국어हिन्दीFrançaisالعربيةРусскийاردوBahasa IndonesiaDeutschTiếng ViệtTürkçeItalianoไทยEspañolবাংলাPortuguês