Claude Sonnet 5.5Sonnet 的价格,接近 Opus 的编程能力
Claude Sonnet 5.5 是 Anthropic Claude 5.5 家族的第二款模型,于 2026 年 9 月 28 日发布。它在 Terminal-Bench 4.0 上得分 70.6%,超过 Opus 5.5 的 66.4%,同时保持 Sonnet 的价格:每百万输入 token $2、每百万输出 token $10。它已上线 Felo AI 搜索和 Felo API。
自 2026 年 9 月 28 日起上线,每百万 token $2 / $10,输出速度比 Sonnet 5 快 30%+。
2026 年 9 月 28 日发布 · 现已上线 Felo AI 搜索和 Felo API
一览
Claude Sonnet 5.5
- 模型 ID
- claude-sonnet-5-5
- 发布日期
- 2026 年 9 月 28 日
- 输入
- 每百万 $2
- 输出
- 每百万 $10
- 缓存输入
- 每百万 $0.20
- 上下文窗口
- 1,000,000 token
价格是 Anthropic 公布的每百万 token 标准 API 费率。提示缓存可将输入成本降低最多 90%,批处理可降低 50%。
70.6%
Terminal-Bench 4.0
智能体编程,超过 Opus 5.5 的 66.4%。
55.5%
CursorBench 4.0
仅落后 Opus 5.5 两分,成本却低得多。
100 万
上下文窗口
输入 100 万 token,输出最高 128K token。
30%+
输出更快
比 Sonnet 5 更快,是迄今最快的 Sonnet。
Sonnet 5.5 的位置
以下是 Anthropic 的发布数据,并列出 Sonnet 5 和 Opus 5.5 作对照。Sonnet 5.5 大幅缩小了与 Opus 5.5 的差距,并在智能体终端编程上实现反超。
基准测试
Sonnet 5.5
Sonnet 5
Opus 5.5
GPT-6 Sol
Terminal-Bench 4.0
70.6%
10.3%
66.4%
—
FrontierCode 1.1
52.1%
42.4%
54.4%
49.3%
CursorBench 4.0
55.5%
34.1%
57.8%
—
GDPval-AA v2.1
1844
1449
1846
1487
OSWorld 2.1
80.1%
57.0%
81.8%
—
Chartography
61.6%
15.6%
64.4%
53.6%
Anthropic 2026 年 9 月发布数据。Terminal-Bench 4.0 和 CursorBench 4.0 取模型的最佳努力档位;FrontierCode 1.1 取 xhigh 档,Sonnet 5.5 在此得 52.1%。GDPval-AA 和 AA-Briefcase 是 Elo 分数,不是百分比。
来源:Anthropic《Introducing Claude Sonnet 5.5》,2026 年 9 月 28 日
Sonnet 的价格,更少的每任务 token
Sonnet 5.5 保持 Sonnet 5 的标价,但完成同样的工作需要的 token 更少。Anthropic 估计,典型工作负载每任务可节省最多 30%。
每百万 token 价格
公布的标准 API 费率。
- 输入
- $2
- 输出
- $10
- 缓存读取
- $0.20
- 缓存写入
- $2.50
提示缓存可将输入成本降低最多 90%,批处理降低 50%。仅美国境内推理按 1.1 倍计费。
客户实测的每任务 token
三项公开结果展示了真实工作负载上的 token 下降。
Balyasny Asset Management
在 2,441 项金融任务中,Sonnet 5.5 每个回答约用 121,000 token,而 Sonnet 5 用了 497,000 —— 减少约 75%。
Box
比 Sonnet 5 快 2.4 倍,总 token 少 12%,并且发现了 Sonnet 5 漏掉的源文档错误。
Slack
在几乎所有离线 Slackbot 评测中结果更好,步骤更少,输出 token 约少 14%。
这些数字来自客户在 Anthropic 发布页上公布的结果,不是 Felo 的测试。
五档努力,两个默认值
努力档位是控制 Sonnet 5.5 思考时长的主要旋钮,也决定了质量、延迟和成本。这些档位相对 Sonnet 5 已重新校准,建议针对自己的评测重新跑一轮。
Low
最快、最便宜。多数简单请求会跳过思考;可能跳过对代码改动的验证。
Medium
Claude 应用中的默认值。适合对话和定义明确的智能体任务。
High
Claude API 的默认值。更难编程和多步工具调用的起点。
Xhigh
额外彻底。Sonnet 5.5 最好的 FrontierCode 成绩 52.1% 就出现在这一档。
Max
思考最多。只用于你已实测到质量提升的工作。
在 FrontierCode 上,Max 得分低于 Xhigh:模型运行了代码审查技能,把工作拆分给子智能体,并在两个案例中超时或改动了任务范围之外的内容。
Sonnet 5.5 擅长什么
Anthropic 将 Sonnet 5.5 定位为处理定义明确的日常工作,复杂、开放式问题仍推荐 Opus 5.5。
智能体编程
能快速理解代码库,动手前先界定改动范围,并把改动控制到便于审查的粒度。适合开发功能、修复缺陷和审查代码。
智能体与工具调用
是 Anthropic 迄今在长时程任务上最强的 Sonnet,并会批量调用工具以减少步骤和成本。Lovable 实测工具调用减少三分之一,shell 运行次数约减半。
设计与视觉工作
能为界面增加细节打磨,生成结构清晰的图表和用户流程,并能按幻灯片模板产出几乎无需修改的演示文稿。
知识与办公工作
在分析、文档和幻灯片中写作更清晰直接。GDPval-AA 得分 1844,与 Opus 5.5 的 1846 仅差两分。
长上下文
100 万 token 窗口,输出最高 128K token。在长上下文编程测试 ProgramBench 上得分 79.7%。
电脑操作与视觉
OSWorld 2.1 得分 80.1%,Chartography 得分 61.6%。是首个仅凭截图通关《宝可梦 红》的 Sonnet 模型。
规格
Anthropic 公布的 Claude Sonnet 5.5 规格。
价格
Claude Sonnet 5.5:每百万 token $2 / $10,缓存读取 $0.20,缓存写入 $2.50。
标准费率。提示缓存最多可节省 90% 的输入成本,批处理节省 50%,仅美国境内推理为 1.1 倍。
上下文窗口
claudeSonnet55.specs.contextBody
与 Opus 5.5 和 Fable 5.1 相同。上下文窗口因评测而异,且不超过 100 万 token。
知识截止
2026 年 6 月,与 Opus 5.5 和 Fable 5.1 一致。
模态
输入文本和图像,输出文本,支持视觉、工具调用和多语言。
推理努力档位
Low、Medium、High、Xhigh 和 Max,API 默认 High,Claude 应用默认 Medium。
数据保留
支持零数据保留。被标记的高风险请求,其网络安全和生物安全防护会回退到 Sonnet 5。
Sonnet 5.5 的运行平台
Anthropic 在自有平台和主流云上提供 Sonnet 5.5,它也已进入开发者工具。
Claude Platform
原生 API,模型 ID 为 claude-sonnet-5-5。
Amazon Web Services
在 Amazon Bedrock 上以 anthropic.claude-sonnet-5-5 提供。
Google Cloud
在 Vertex AI 上以相同模型 ID 提供。
Microsoft Foundry
在 Microsoft Foundry 和 Microsoft Azure 上提供。
GitHub Copilot
2026 年 9 月 28 日起面向 Pro、Pro+、Max、Business 和 Enterprise 全面可用。
Felo AI 搜索和 Felo API
可在 Felo AI 搜索中使用,或通过 Felo OpenAPI 调用。
常见问题
Claude Sonnet 5.5 是 Anthropic 的 Sonnet 级模型,于 2026 年 9 月 28 日发布,是 Claude 5.5 家族的第二款模型。它是 Opus 5.5 更快、更便宜的补充,面向定义明确的日常工作,例如修复缺陷、开发功能和制作精致的文档、幻灯片与表格。价格为每百万输入 token $2、每百万输出 token $10。
在 Felo 体验 Claude Sonnet 5.5
Anthropic 的 Sonnet 级模型:Terminal-Bench 4.0 得分 70.6%,每百万 token 输入 $2、输出 $10,100 万 token 窗口。
已上线 Felo AI 搜索和 Felo API