Claude Sonnet 5.5 現已於 Felo Search 免費開放:近乎 Opus 的答案,Sonnet 價格
Claude Sonnet 5.5 已於 Felo Search 上線:Terminal-Bench 4.0 得分 70.6%,支援 1M-token 上下文,價格為 $2/$10。以下是這些變化對你的研究帶來的影響。
Anthropic 於 2026 年 9 月 28 日推出 Claude Sonnet 5.5,重點不在價格,而是 Terminal-Bench 4.0 得分 70.6%——比 Claude Opus 5.5 高出四分,且後者價格為前者兩倍。
Sonnet 5.5 現已於 Felo Search 上線。這是 Sonnet 級別的模型,價格為每百萬輸入 token $2、每百萬輸出 $10,縮小與旗艦型號的差距,並在代理式編碼上超越旗艦。對於需要多步驟循環後才給出答案的搜尋引擎,這種組合比排行榜名次更重要。

Claude Sonnet 5.5 是什麼
Sonnet 5.5 是 Anthropic Claude 5.5 系列的第二款模型,在 Opus 5.5 發布一週後推出。這不是新的旗艦型號,而是多數團隊實際在生產環境中運行的等級,這次升級讓這個等級足以取代高價型號。
| 規格 | Claude Sonnet 5.5 |
|---|---|
| Model ID | claude-sonnet-5-5 |
| Maker | Anthropic |
| Released | September 28, 2026 |
| Context window | 1,000,000 tokens |
| Max output | 128,000 tokens |
| Input | Text, image |
| Output | Text |
| Price | $2 per million input, $10 per million output |
| Cached input | $0.20 per million tokens |
| Knowledge cutoff | June 2026 |
有兩項規格最關鍵。一百萬 token 的上下文視窗,讓研究討論串可完整容納一個程式庫、檔案集或多份原始文件,不需中途摘要。快取讀取價格僅為輸入的五分之一,搜尋循環反覆讀取時,成本不再成為負擔。
價格與 Sonnet 5 相同,改變的是你能獲得的能力。
搜尋最重要的數據
Anthropic 公布了發佈時的基準測試,值得細讀。Sonnet 5.5 並非全面領先,而是在與搜尋答案實際工作最相關的項目中勝出。
| Benchmark | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% |
| FrontierCode 1.1 | 52.1% | 42.4% | 54.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% |
| Chartography | 61.6% | 15.6% | 64.4% |
Anthropic 發布數據,2026 年 9 月。Terminal-Bench 4.0 與 CursorBench 4.0 以模型最佳表現報告;FrontierCode 1.1 為 xhigh 水準。
先看 Sonnet 5,再看 Sonnet 5.5。Terminal-Bench 從 10.3% 躍升至 70.6%。CursorBench 幾乎翻倍。這不是小幅升級,而是全新模型,價格卻不變。

Opus 5.5 仍領先的項目,差距僅一到三分——Anthropic 官方建議,Opus 適合需要持續判斷的複雜、開放式問題。對於範圍明確的日常工作,差距已小到價格成為決定因素。
這如何改變 Felo Search 的能力
Felo Search 的單一問題並非只呼叫一次模型,而是一個循環:決定查什麼、讀取結果、判斷是否足夠、再次查找、整合來源、最後撰寫。規劃、工具選擇與重試都會消耗 token,深入調查時,這個循環可能跑十幾次。
這個循環讓模型價格不再只是抽象數字。Opus 價格下,完整多輪調查會成為實際成本,系統必須控制循環次數。Sonnet 5.5 價格下,限制放寬。
還有兩點加乘效果:
- 輸出速度比 Sonnet 5 快 30% 以上。 多輪搜尋時,每輪更快,整體體驗明顯不同。
- 每個任務所需 token 更少。 Anthropic 估計典型工作量可減少最多 30%。Balyasny Asset Management 在 2,441 個金融任務上測得每個答案約 121,000 token,Sonnet 5 則需約 497,000。Box 回報輸出速度提升 2.4 倍,總 token 減少 12%。Slack 在更少步驟下獲得更好結果,輸出 token 減少約 14%。
每個答案所需 token 減少、輸出更快、單位 token 價格更低,這些都指向同一方向:答案送達前可進行更多驗證回合。
如何在 Felo Search 使用 Claude Sonnet 5.5
1. 開啟模型選擇器,選擇 Claude Sonnet 5.5。 同一搜尋框、同一資料來源、同一工作區,介面其他部分不變。
2. 提問需要多輪處理的問題。 Sonnet 5.5 的優勢在於需要循環的問題:比較、驗證、整合。單一事實查詢不需用到這個等級。
3. 充分利用完整上下文,不必裁切。 一百萬 token 足以讓所有來源完整參與長時間調查,不必壓縮成一頁而失去細節。
4. 讓模型自我檢查。 代理式基準測試的進步,讓多步驟答案更值得信任。除了結論,也可要求列出限制與注意事項。
5. 有意識地升級。 當問題需要持續判斷時,直接切換到更強模型,現有證據仍保留在上下文中。共用介面讓交接過程順暢。
Sonnet 5.5 在 Felo Search 的定位
Felo Search 支援多款模型,選擇重點在於將等級與問題匹配。
| Model | Price per million tokens | Context | Built for |
|---|---|---|---|
| Claude Sonnet 5.5 | $2 in / $10 out | 1M | 針對範圍明確、多步驟工作,提供近乎 Opus 的品質 |
| Claude Opus 5.5 | $4 in / $20 out | 1M | 通過嚴格驗證的答案 |
| GPT-6 Sol | $2 in / $10 out | 1.05M | 代理循環與多次呼叫,中階價格 |
| GPT-6 Luna | $0.10 in / $0.50 out | 1.05M | 大量搜尋,單次成本最低 |
Sonnet 5.5 與 GPT-6 Sol 價格相同,特性不同:Sol 支援更大上下文,Sonnet 5.5 在代理式終端編碼領先,Anthropic 針對細緻、範圍明確的工作調校。可將同一問題分別交給兩者,比較其限制與注意事項,而非僅看文字表現。
建議先嘗試的用法
你打算引用的主張。 選一個即將寫入文件的統計數據,請 Sonnet 5.5 追溯其來源。重點在於推理過程,而非數字本身。
三方比較。 詢問三家廠商、各自價格與隱藏的限制。這類問題需多輪檢索,正好體現每輪價格的優勢。
程式庫規模的問題。 指定大量文件,詢問特定行為如何實現,並要求引用原始檔案。
你需要反駁的文件。 貼上一份合約,詢問其未涵蓋內容。上下文視窗讓「全部閱讀」成為可行指令。
立即於 Felo Search 體驗 Claude Sonnet 5.5
Claude Sonnet 5.5 現已於 Felo Search 上線,支援一百萬 token 上下文、圖像輸入,價格為 $2/$10——與 Sonnet 5 相同,但基準分數大幅躍升。代理式終端編碼超越 Opus 5.5,成本僅為一半,現已可用。
立即於 Felo Search 開啟 Claude Sonnet 5.5 →
本文也提供以下語言版本:English、简体中文、日本語、한국어、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。