Skip to main content

Claude Opus 5.5 現已加入 Felo Search:經得起考驗的答案

· 閱讀時間約 7 分鐘
Felo Search Tips Buddy
Committed to answers at your fingertips

Claude Opus 5.5 已在 Felo Search 上線:百萬字元脈絡,$4/$20 每百萬字元,並在你採取行動前,根據證據驗證答案。

Anthropic 於 9 月 22 日推出 Claude Opus 5.5,這次對搜尋最重要的數字不在基準表上,而是價格:每百萬輸入字元 $4、每百萬輸出 $20,相較於 Opus 5 的 $5 與 $25。Anthropic 表示,在典型工作負載下,運算成本降低約 40%,輸出速度提升超過 30%。

Opus 5.5 現已在 Felo Search 上線。更便宜、更快已經很有吸引力。這一代值得研究人員切換的原因,在於它同時變得更謹慎。

Claude Opus 5.5 in Felo Search: a one-million-token context holding sources, evidence, and caveats together

Claude Opus 5.5 是什麼​

Opus 5.5 是 Anthropic 自 9 月公開呼籲放緩前沿模型發展後的首個版本。它位於 Opus 系列頂端,高於 Claude Sonnet 5,Fable 系列則保留給不同部署場景。

這個規格專為需要「可辯護」而非僅僅「產出」的工作設計:百萬字元脈絡視窗、最大輸出 128,000 字元,以及每百萬字元 $0.20 的快取讀取費用,讓長時間、反覆的工作流程變得可負擔。

SpecClaude Opus 5.5
Model IDclaude-opus-5-5
MakerAnthropic
ReleasedSeptember 22, 2026
Context window1,000,000 tokens
Max output128,000 tokens
InputText, image
OutputText
Price$4 per million input, $20 per million output
Cached input$0.20 per million tokens
Prior generationOpus 5, released July 24, 2026 at $5 / $25

表格中的兩項規格,讓研究工作流程感受這個模型的不同。

百萬字元脈絡。 這約等於 75 萬字,一疊原始文件,不需事先摘要就能直接提問。摘要階段容易產生錯誤,因為摘要模型無法預知你需要哪些細節。

快取讀取僅為輸入價格五分之一。 Felo Search 的調查不只一次呼叫,而是初步檢索、質疑、修正、整合,每一步都會重讀相同來源。快取讓重複讀取的成本幾乎可以忽略。

為什麼驗證是 AI 搜尋的核心問題​

詢問 AI 搜尋引擎問題,會得到流暢的答案。這已經不困難。困難在於,判斷你即將採取行動的句子,能否經得起查證。

驗證與摘要是不同的能力。驗證需要發現兩個來源描述同一統計數據時,分母不同。需要標註某個主張僅有新聞稿支持。需要在證據薄弱時,回應「這裡的證據不足」,而不是寫出自信的段落。

Anthropic 在 Opus 5.5 發布時公布四項基準,值得細讀其表現:

BenchmarkClaude Opus 5.5GPT-6 Astra
Terminal-Bench 4.066.4%57.9%
FrontierCode v1.1 (Main)54.4%53.3%
AutomationBench40.0%41.4%
Terminal-Bench-Science 0.158.7%64.6%

Anthropic 在兩項領先、兩項落後,這比全部勝出更具參考價值。Astra 在科學密集型終端任務與業務流程自動化領域保持優勢;Opus 5.5 則在一般代理式編碼與前沿代碼表現突出。

評測方法比分數更重要。Anthropic 以啟用正式安全防護的狀態評估 Opus 5.5:這與用戶實際使用時相同,包括將高風險請求導向舊模型的路由。僅存在於評測中的安全系統,不算真正的安全。官方也報告,Opus 5.5 嘗試繞過安全邊界的次數比 Opus 5 減少約 85%,對齊表現為歷來最佳。

對搜尋而言,這套配置就是產品本身。模型拒絕回答會讓人困擾,但模型對應該拒答的問題給出流暢且有引註的答案,後果更嚴重。

如何在 Felo Search 使用 Claude Opus 5.5​

1. 在模型選單中選擇。 開啟 Felo Search,選擇 Claude Opus 5.5,直接在原本的輸入框提問。

2. 提供完整文件集,不要摘要。 百萬字元視窗最適合直接處理原始內容。上傳所有申報資料、論文、討論串,針對全文提問。

3. 明確要求列出限制。 「哪些情況會讓這個結論不成立?」、「哪個來源最薄弱?」這類問題,經過驗證訓練的模型會給出不同於摘要模型的答案。

4. 要求呈現分歧。 當來源意見不一致時,請它列出共識、分歧,以及哪個主張證據最薄弱。這才是研究過程真正需要的輸出。

5. 在同一討論串反覆提問。 快取讀取便宜,重啟不划算。將質疑、修正、整合都放在同一會話,讓模型持續掌握原始證據。

另外三款模型也在 Felo Search 上線​

Opus 5.5 與其他三款前沿模型幾乎同時發表,Felo Search 全部支援。

ModelReleased byPrice per million tokensContextBuilt for
Grok 4.7SpaceXAI$2 in / $6 out500K長期推理與知識工作
Claude Opus 5.5Anthropic$4 in / $20 out1M經得起驗證的答案
GPT-6 LunaOpenAI$0.10 in / $0.50 out1.05M低成本大規模搜尋
GPT-6 SolOpenAI$2 in / $10 out1.05M代理循環與中價位重複呼叫

Opus 5.5 的輸出價格在四款中最高,也是唯一公開安全配置與分數的模型。適合用在錯誤代價高於速度的問題。

首次體驗建議​

你準備引用的主張。 挑一個即將寫進文件的統計數字,請 Opus 5.5 追溯其來源。重點不在數字,而在於來源鏈。

有兩個合理答案的決策。 提供兩個選項與限制條件,詢問證據支持哪一個,以及哪些情況會改變答案。

你即將簽署的文件。 合約、政策、服務條款,適合用模型指出缺漏,而非僅僅列出內容。

你已經跑過的研究討論串。 重新執行一個月前的問題,比較模型給出的限制。這個差距,就是上一代模型未做到的。

立即在 Felo Search 體驗 Claude Opus 5.5​

Claude Opus 5.5 已在 Felo Search 上線,具備百萬字元脈絡、$4/$20 價格與正式安全防護。運算成本比前代低 40%,這也是 Anthropic 官方推薦的配置。

開啟 Claude Opus 5.5 in Felo Search →


本文也提供以下語言版本:English、简体中文、日本語、한국어、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。