2026 年 9 月 28 日发布

Claude Sonnet 5.5Sonnet 的价格,接近 Opus 的编程能力

Claude Sonnet 5.5 是 Anthropic Claude 5.5 家族的第二款模型,于 2026 年 9 月 28 日发布。它在 Terminal-Bench 4.0 上得分 70.6%,超过 Opus 5.5 的 66.4%,同时保持 Sonnet 的价格:每百万输入 token $2、每百万输出 token $10。它已上线 Felo AI 搜索和 Felo API。

自 2026 年 9 月 28 日起上线,每百万 token $2 / $10,输出速度比 Sonnet 5 快 30%+。

2026 年 9 月 28 日发布 · 现已上线 Felo AI 搜索和 Felo API

一览

Claude Sonnet 5.5

模型 ID
claude-sonnet-5-5
发布日期
2026 年 9 月 28 日
输入
每百万 $2
输出
每百万 $10
缓存输入
每百万 $0.20
上下文窗口
1,000,000 token

价格是 Anthropic 公布的每百万 token 标准 API 费率。提示缓存可将输入成本降低最多 90%,批处理可降低 50%。

70.6%

Terminal-Bench 4.0

智能体编程,超过 Opus 5.5 的 66.4%。

55.5%

CursorBench 4.0

仅落后 Opus 5.5 两分,成本却低得多。

100 万

上下文窗口

输入 100 万 token,输出最高 128K token。

30%+

输出更快

比 Sonnet 5 更快,是迄今最快的 Sonnet。

基准测试

Sonnet 5.5 的位置

以下是 Anthropic 的发布数据,并列出 Sonnet 5 和 Opus 5.5 作对照。Sonnet 5.5 大幅缩小了与 Opus 5.5 的差距,并在智能体终端编程上实现反超。

基准测试

Sonnet 5.5

Sonnet 5

Opus 5.5

GPT-6 Sol

Terminal-Bench 4.0

70.6%

10.3%

66.4%

—

FrontierCode 1.1

52.1%

42.4%

54.4%

49.3%

CursorBench 4.0

55.5%

34.1%

57.8%

—

GDPval-AA v2.1

1844

1449

1846

1487

OSWorld 2.1

80.1%

57.0%

81.8%

—

Chartography

61.6%

15.6%

64.4%

53.6%

Anthropic 2026 年 9 月发布数据。Terminal-Bench 4.0 和 CursorBench 4.0 取模型的最佳努力档位;FrontierCode 1.1 取 xhigh 档,Sonnet 5.5 在此得 52.1%。GDPval-AA 和 AA-Briefcase 是 Elo 分数,不是百分比。

来源:Anthropic《Introducing Claude Sonnet 5.5》,2026 年 9 月 28 日

成本

Sonnet 的价格,更少的每任务 token

Sonnet 5.5 保持 Sonnet 5 的标价,但完成同样的工作需要的 token 更少。Anthropic 估计,典型工作负载每任务可节省最多 30%。

每百万 token 价格

公布的标准 API 费率。

输入
$2
输出
$10
缓存读取
$0.20
缓存写入
$2.50

提示缓存可将输入成本降低最多 90%,批处理降低 50%。仅美国境内推理按 1.1 倍计费。

客户实测的每任务 token

三项公开结果展示了真实工作负载上的 token 下降。

Balyasny Asset Management

在 2,441 项金融任务中,Sonnet 5.5 每个回答约用 121,000 token,而 Sonnet 5 用了 497,000 —— 减少约 75%。

Box

比 Sonnet 5 快 2.4 倍,总 token 少 12%,并且发现了 Sonnet 5 漏掉的源文档错误。

Slack

在几乎所有离线 Slackbot 评测中结果更好,步骤更少,输出 token 约少 14%。

这些数字来自客户在 Anthropic 发布页上公布的结果,不是 Felo 的测试。

努力档位控制

五档努力,两个默认值

努力档位是控制 Sonnet 5.5 思考时长的主要旋钮,也决定了质量、延迟和成本。这些档位相对 Sonnet 5 已重新校准,建议针对自己的评测重新跑一轮。

Low

最快、最便宜。多数简单请求会跳过思考;可能跳过对代码改动的验证。

Medium

Claude 应用中的默认值。适合对话和定义明确的智能体任务。

High

Claude API 的默认值。更难编程和多步工具调用的起点。

Xhigh

额外彻底。Sonnet 5.5 最好的 FrontierCode 成绩 52.1% 就出现在这一档。

Max

思考最多。只用于你已实测到质量提升的工作。

在 FrontierCode 上,Max 得分低于 Xhigh:模型运行了代码审查技能,把工作拆分给子智能体,并在两个案例中超时或改动了任务范围之外的内容。

能力

Sonnet 5.5 擅长什么

Anthropic 将 Sonnet 5.5 定位为处理定义明确的日常工作,复杂、开放式问题仍推荐 Opus 5.5。

智能体编程

能快速理解代码库,动手前先界定改动范围,并把改动控制到便于审查的粒度。适合开发功能、修复缺陷和审查代码。

智能体与工具调用

是 Anthropic 迄今在长时程任务上最强的 Sonnet,并会批量调用工具以减少步骤和成本。Lovable 实测工具调用减少三分之一,shell 运行次数约减半。

设计与视觉工作

能为界面增加细节打磨,生成结构清晰的图表和用户流程,并能按幻灯片模板产出几乎无需修改的演示文稿。

知识与办公工作

在分析、文档和幻灯片中写作更清晰直接。GDPval-AA 得分 1844,与 Opus 5.5 的 1846 仅差两分。

长上下文

100 万 token 窗口,输出最高 128K token。在长上下文编程测试 ProgramBench 上得分 79.7%。

电脑操作与视觉

OSWorld 2.1 得分 80.1%,Chartography 得分 61.6%。是首个仅凭截图通关《宝可梦 红》的 Sonnet 模型。

规格

Anthropic 公布的 Claude Sonnet 5.5 规格。

价格

Claude Sonnet 5.5:每百万 token $2 / $10,缓存读取 $0.20,缓存写入 $2.50。

标准费率。提示缓存最多可节省 90% 的输入成本,批处理节省 50%,仅美国境内推理为 1.1 倍。

上下文窗口

claudeSonnet55.specs.contextBody

与 Opus 5.5 和 Fable 5.1 相同。上下文窗口因评测而异,且不超过 100 万 token。

知识截止

2026 年 6 月,与 Opus 5.5 和 Fable 5.1 一致。

模态

输入文本和图像,输出文本,支持视觉、工具调用和多语言。

推理努力档位

Low、Medium、High、Xhigh 和 Max,API 默认 High,Claude 应用默认 Medium。

数据保留

支持零数据保留。被标记的高风险请求,其网络安全和生物安全防护会回退到 Sonnet 5。

Sonnet 5.5 的运行平台

Anthropic 在自有平台和主流云上提供 Sonnet 5.5,它也已进入开发者工具。

Claude Platform

原生 API,模型 ID 为 claude-sonnet-5-5。

Amazon Web Services

在 Amazon Bedrock 上以 anthropic.claude-sonnet-5-5 提供。

Google Cloud

在 Vertex AI 上以相同模型 ID 提供。

Microsoft Foundry

在 Microsoft Foundry 和 Microsoft Azure 上提供。

GitHub Copilot

2026 年 9 月 28 日起面向 Pro、Pro+、Max、Business 和 Enterprise 全面可用。

Felo AI 搜索和 Felo API

可在 Felo AI 搜索中使用,或通过 Felo OpenAPI 调用。

常见问题

Claude Sonnet 5.5 是 Anthropic 的 Sonnet 级模型,于 2026 年 9 月 28 日发布,是 Claude 5.5 家族的第二款模型。它是 Opus 5.5 更快、更便宜的补充,面向定义明确的日常工作,例如修复缺陷、开发功能和制作精致的文档、幻灯片与表格。价格为每百万输入 token $2、每百万输出 token $10。

在 Felo 体验 Claude Sonnet 5.5

Anthropic 的 Sonnet 级模型:Terminal-Bench 4.0 得分 70.6%,每百万 token 输入 $2、输出 $10,100 万 token 窗口。

已上线 Felo AI 搜索和 Felo API