2026 年 9 月 28 日發布

Claude Sonnet 5.5Sonnet 的價格,接近 Opus 的程式能力

Claude Sonnet 5.5 是 Anthropic Claude 5.5 家族的第二款模型,於 2026 年 9 月 28 日發布。它在 Terminal-Bench 4.0 拿下 70.6%,超越 Opus 5.5 的 66.4%,同時維持 Sonnet 的價格:每百萬輸入 token $2、每百萬輸出 token $10。它已上線 Felo AI 搜尋與 Felo API。

自 2026 年 9 月 28 日起上線,每百萬 token $2 / $10,輸出速度比 Sonnet 5 快 30%+。

2026 年 9 月 28 日發布 · 現已上線 Felo AI 搜尋與 Felo API

一覽

Claude Sonnet 5.5

模型 ID
claude-sonnet-5-5
發布日期
2026 年 9 月 28 日
輸入
每百萬 $2
輸出
每百萬 $10
快取輸入
每百萬 $0.20
上下文視窗
1,000,000 token

價格為 Anthropic 公布的每百萬 token 標準 API 費率。提示快取可將輸入成本降低最多 90%,批次處理可降低 50%。

70.6%

Terminal-Bench 4.0

代理程式編碼,超越 Opus 5.5 的 66.4%。

55.5%

CursorBench 4.0

僅落後 Opus 5.5 兩分,成本卻低得多。

100 萬

上下文視窗

輸入 100 萬 token,輸出最高 128K token。

30%+

輸出更快

比 Sonnet 5 更快,是歷來最快的 Sonnet。

基準測試

Sonnet 5.5 的位置

以下是 Anthropic 的發布數據,並列出 Sonnet 5 與 Opus 5.5 作為對照。Sonnet 5.5 大幅縮小與 Opus 5.5 的差距,並在代理程式終端編碼上實現反超。

基準測試

Sonnet 5.5

Sonnet 5

Opus 5.5

GPT-6 Sol

Terminal-Bench 4.0

70.6%

10.3%

66.4%

—

FrontierCode 1.1

52.1%

42.4%

54.4%

49.3%

CursorBench 4.0

55.5%

34.1%

57.8%

—

GDPval-AA v2.1

1844

1449

1846

1487

OSWorld 2.1

80.1%

57.0%

81.8%

—

Chartography

61.6%

15.6%

64.4%

53.6%

Anthropic 2026 年 9 月發布數據。Terminal-Bench 4.0 與 CursorBench 4.0 取模型的最佳努力檔位;FrontierCode 1.1 取 xhigh 檔,Sonnet 5.5 在此得 52.1%。GDPval-AA 與 AA-Briefcase 是 Elo 分數,不是百分比。

來源:Anthropic《Introducing Claude Sonnet 5.5》,2026 年 9 月 28 日

成本

Sonnet 的價格,更少的每任務 token

Sonnet 5.5 維持 Sonnet 5 的標價,但完成同樣工作所需的 token 更少。Anthropic 估計,典型工作負載每任務最多可省下 30%。

每百萬 token 價格

公布的标准 API 費率。

輸入
$2
輸出
$10
快取讀取
$0.20
快取寫入
$2.50

提示快取可將輸入成本降低最多 90%,批次處理降低 50%。僅美國境內推論以 1.1 倍計費。

客戶實測的每任務 token

三項公開結果顯示真實工作負載上的 token 下降。

Balyasny Asset Management

在 2,441 項金融任務中,Sonnet 5.5 每個回答約用 121,000 token,而 Sonnet 5 用了 497,000 —— 減少約 75%。

Box

比 Sonnet 5 快 2.4 倍,總 token 少 12%,並找出 Sonnet 5 漏掉的來源文件錯誤。

Slack

在幾乎所有離線 Slackbot 評測中結果更好,步驟更少,輸出 token 約少 14%。

這些數字來自客戶在 Anthropic 發布頁公布的結果,不是 Felo 的測試。

努力檔位控制

五檔努力,兩個預設值

努力檔位是控制 Sonnet 5.5 思考時間的主要旋鈕,也決定品質、延遲與成本。這些檔位相對 Sonnet 5 已重新校準,建議針對自己的評測重跑一輪。

Low

最快、最便宜。多數簡單請求會跳過思考;可能跳過對程式改動的驗證。

Medium

Claude 應用程式中的預設值。適合對話與定義明確的代理程式任務。

High

Claude API 的預設值。較難程式開發與多步工具呼叫的起點。

Xhigh

額外徹底。Sonnet 5.5 最好的 FrontierCode 成績 52.1% 就出現在這一檔。

Max

思考最多。只用於你已實測到品質提升的工作。

在 FrontierCode 上,Max 得分低於 Xhigh:模型執行了程式碼審查技能,把工作拆分給子代理程式,並在兩個案例中超時或改動了任務範圍之外的內容。

能力

Sonnet 5.5 擅長什麼

Anthropic 將 Sonnet 5.5 定位為處理定義明確的日常工作,複雜、開放式問題仍推薦 Opus 5.5。

代理程式編碼

能快速理解程式庫,動手前先界定改動範圍,並把改動控制到易於審查的粒度。適合開發功能、修復缺陷與審查程式碼。

代理程式與工具呼叫

是 Anthropic 歷來在長時程任務上最強的 Sonnet,並會批次呼叫工具以減少步驟與成本。Lovable 實測工具呼叫減少三分之一,shell 執行次數約減半。

設計與視覺工作

能為介面增加細節打磨,產生結構清晰的圖表與使用者流程,並能依簡報模板產出幾乎無需修改的投影片。

知識與辦公工作

在分析、文件與簡報中寫作更清晰直接。GDPval-AA 得分 1844,與 Opus 5.5 的 1846 僅差兩分。

長上下文

100 萬 token 視窗,輸出最高 128K token。在長上下文程式測試 ProgramBench 上得分 79.7%。

電腦操作與視覺

OSWorld 2.1 得分 80.1%,Chartography 得分 61.6%。是首個僅憑截圖通關《寶可夢 紅》的 Sonnet 模型。

規格

Anthropic 公布的 Claude Sonnet 5.5 規格。

價格

Claude Sonnet 5.5:每百萬 token $2 / $10,快取讀取 $0.20,快取寫入 $2.50。

標準費率。提示快取最多可省下 90% 的輸入成本,批次處理省下 50%,僅美國境內推論為 1.1 倍。

上下文視窗

claudeSonnet55.specs.contextBody

與 Opus 5.5 和 Fable 5.1 相同。上下文視窗因評測而異,且不超過 100 萬 token。

知識截止

2026 年 6 月,與 Opus 5.5 和 Fable 5.1 一致。

模態

輸入文字與圖像,輸出文字,支援視覺、工具呼叫與多語言。

推論努力檔位

Low、Medium、High、Xhigh 與 Max,API 預設 High,Claude 應用程式預設 Medium。

資料保留

支援零資料保留。被標記的高風險請求,其網路安全與生物安全防護會回退到 Sonnet 5。

Sonnet 5.5 的執行平台

Anthropic 在自有平台與主流雲上提供 Sonnet 5.5,它也已進入開發者工具。

Claude Platform

原生 API,模型 ID 為 claude-sonnet-5-5。

Amazon Web Services

在 Amazon Bedrock 上以 anthropic.claude-sonnet-5-5 提供。

Google Cloud

在 Vertex AI 上以相同模型 ID 提供。

Microsoft Foundry

在 Microsoft Foundry 與 Microsoft Azure 上提供。

GitHub Copilot

2026 年 9 月 28 日起,向 Pro、Pro+、Max、Business 與 Enterprise 全面開放。

Felo AI 搜尋與 Felo API

可在 Felo AI 搜尋中使用,或透過 Felo OpenAPI 呼叫。

常見問題

Claude Sonnet 5.5 是 Anthropic 的 Sonnet 級模型,於 2026 年 9 月 28 日發布,是 Claude 5.5 家族的第二款模型。它是 Opus 5.5 更快、更便宜的補充,面向定義明確的日常工作,例如修復缺陷、開發功能與製作精緻的文件、簡報與試算表。價格為每百萬輸入 token $2、每百萬輸出 token $10。

在 Felo 體驗 Claude Sonnet 5.5

Anthropic 的 Sonnet 級模型:Terminal-Bench 4.0 得分 70.6%,每百萬 token 輸入 $2、輸出 $10,100 萬 token 視窗。

已上線 Felo AI 搜尋與 Felo API