Claude Opus 5.5 現已加入 Felo Search:經得起考驗的答案
Claude Opus 5.5 已在 Felo Search 上線:百萬字元脈絡,$4/$20 每百萬字元,並在你採取行動前,根據證據驗證答案。
Anthropic 於 9 月 22 日推出 Claude Opus 5.5,這次對搜尋最重要的數字不在基準表上,而是價格:每百萬輸入字元 $4、每百萬輸出 $20,相較於 Opus 5 的 $5 與 $25。Anthropic 表示,在典型工作負載下,運算成本降低約 40%,輸出速度提升超過 30%。
Opus 5.5 現已在 Felo Search 上線。更便宜、更快已經很有吸引力。這一代值得研究人員切換的原因,在於它同時變得更謹慎。

Claude Opus 5.5 是什麼
Opus 5.5 是 Anthropic 自 9 月公開呼籲放緩前沿模型發展後的首個版本。它位於 Opus 系列頂端,高於 Claude Sonnet 5,Fable 系列則保留給不同部署場景。
這個規格專為需要「可辯護」而非僅僅「產出」的工作設計:百萬字元脈絡視窗、最大輸出 128,000 字元,以及每百萬字元 $0.20 的快取讀取費用,讓長時間、反覆的工作流程變得可負擔。
| Spec | Claude Opus 5.5 |
|---|---|
| Model ID | claude-opus-5-5 |
| Maker | Anthropic |
| Released | September 22, 2026 |
| Context window | 1,000,000 tokens |
| Max output | 128,000 tokens |
| Input | Text, image |
| Output | Text |
| Price | $4 per million input, $20 per million output |
| Cached input | $0.20 per million tokens |
| Prior generation | Opus 5, released July 24, 2026 at $5 / $25 |
表格中的兩項規格,讓研究工作流程感受這個模型的不同。
百萬字元脈絡。 這約等於 75 萬字,一疊原始文件,不需事先摘要就能直接提問。摘要階段容易產生錯誤,因為摘要模型無法預知你需要哪些細節。
快取讀取僅為輸入價格五分之一。 Felo Search 的調查不只一次呼叫,而是初步檢索、質疑、修正、整合,每一步都會重讀相同來源。快取讓重複讀取的成本幾乎可以忽略。
為什麼驗證是 AI 搜尋的核心問題
詢問 AI 搜尋引擎問題,會得到流暢的答案。這已經不困難。困難在於,判斷你即將採取行動的句子,能否經得起查證。
驗證與摘要是不同的能力。驗證需要發現兩個來源描述同一統計數據時,分母不同。需要標註某個主張僅有新聞稿支持。需要在證據薄弱時,回應「這裡的證據不足」,而不是寫出自信的段落。
Anthropic 在 Opus 5.5 發布時公布四項基準,值得細讀其表現:
| Benchmark | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 57.9% |
| FrontierCode v1.1 (Main) | 54.4% | 53.3% |
| AutomationBench | 40.0% | 41.4% |
| Terminal-Bench-Science 0.1 | 58.7% | 64.6% |
Anthropic 在兩項領先、兩項落後,這比全部勝出更具參考價值。Astra 在科學密集型終端任務與業務流程自動化領域保持優勢;Opus 5.5 則在一般代理式編碼與前沿代碼表現突出。
評測方法比分數更重要。Anthropic 以啟用正式安全防護的狀態評估 Opus 5.5:這與用戶實際使用時相同,包括將高風險請求導向舊模型的路由。僅存在於評測中的安全系統,不算真正的安全。官方也報告,Opus 5.5 嘗試繞過安全邊界的次數比 Opus 5 減少約 85%,對齊表現為歷來最佳。
對搜尋而言,這套配置就是產品本身。模型拒絕回答會讓人困擾,但模型對應該拒答的問題給出流暢且有引註的答案,後果更嚴重。
如何在 Felo Search 使用 Claude Opus 5.5
1. 在模型選單中選擇。 開啟 Felo Search,選擇 Claude Opus 5.5,直接在原本的輸入框提問。
2. 提供完整文件集,不要摘要。 百萬字元視窗最適合直接處理原始內容。上傳所有申報資料、論文、討論串,針對全文提問。
3. 明確要求列出限制。 「哪些情況會讓這個結論不成立?」、「哪個來源最薄弱?」這類問題,經過驗證訓練的模型會給出不同於摘要模型的答案。
4. 要求呈現分歧。 當來源意見不一致時,請它列出共識、分歧,以及哪個主張證據最薄弱。這才是研究過程真正需要的輸出。
5. 在同一討論串反覆提問。 快取讀取便宜,重啟不划算。將質疑、修正、整合都放在同一會話,讓模型持續掌握原始證據。
另外三款模型也在 Felo Search 上線
Opus 5.5 與其他三款前沿模型幾乎同時發表,Felo Search 全部支援。
| Model | Released by | Price per million tokens | Context | Built for |
|---|---|---|---|---|
| Grok 4.7 | SpaceXAI | $2 in / $6 out | 500K | 長期推理與知識工作 |
| Claude Opus 5.5 | Anthropic | $4 in / $20 out | 1M | 經得起驗證的答案 |
| GPT-6 Luna | OpenAI | $0.10 in / $0.50 out | 1.05M | 低成本大規模搜尋 |
| GPT-6 Sol | OpenAI | $2 in / $10 out | 1.05M | 代理循環與中價位重複呼叫 |
Opus 5.5 的輸出價格在四款中最高,也是唯一公開安全配置與分數的模型。適合用在錯誤代價高於速度的問題。
首次體驗建議
你準備引用的主張。 挑一個即將寫進文件的統計數字,請 Opus 5.5 追溯其來源。重點不在數字,而在於來源鏈。
有兩個合理答案的決策。 提供兩個選項與限制條件,詢問證據支持哪一個,以及哪些情況會改變答案。
你即將簽署的文件。 合約、政策、服務條款,適合用模型指出缺漏,而非僅僅列出內容。
你已經跑過的研究討論串。 重新執行一個月前的問題,比較模型給出的限制。這個差距,就是上一代模型未做到的。
立即在 Felo Search 體驗 Claude Opus 5.5
Claude Opus 5.5 已在 Felo Search 上線,具備百萬字元脈絡、$4/$20 價格與正式安全防護。運算成本比前代低 40%,這也是 Anthropic 官方推薦的配置。
開啟 Claude Opus 5.5 in Felo Search →
本文也提供以下語言版本:English、简体中文、日本語、한국어、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。