Claude Sonnet 5.5现已在Felo Search免费开放:接近Opus的答案,Sonnet的价格
Claude Sonnet 5.5已上线Felo Search:在Terminal-Bench 4.0上达到70.6%,拥有100万token上下文窗口,定价为$2/$10。以下是对您的研究带来的变化。
Anthropic于2026年9月28日发布了Claude Sonnet 5.5,最引人注目的数字并不是价格,而是在Terminal-Bench 4.0上达到70.6%——比Claude Opus 5.5高出四个百分点,而后者的价格是前者的两倍。
Sonnet 5.5现已在Felo Search上线。作为Sonnet级别的模型,输入每百万token收费$2,输出每百万token收费$10,在大多数任务上缩小了与旗舰模型的差距,并在自主编码方面超越了它。对于需要多步循环才能给出答案的搜索引擎,这种组合比排行榜上的胜利更重要。

Claude Sonnet 5.5是什么
Sonnet 5.5是Anthropic Claude 5.5系列的第二款模型,发布于Opus 5.5之后一周。它不是新的旗舰,而是大多数团队实际在生产环境中使用的级别,这次发布旨在让这个级别足够强大,无需再选择昂贵的旗舰。
| 规格 | Claude Sonnet 5.5 |
|---|---|
| 模型ID | claude-sonnet-5-5 |
| 开发者 | Anthropic |
| 发布日期 | 2026年9月28日 |
| 上下文窗口 | 1,000,000 tokens |
| 最大输出 | 128,000 tokens |
| 输入 | 文本,图片 |
| 输出 | 文本 |
| 价格 | 输入每百万token $2,输出每百万token $10 |
| 缓存输入 | 每百万token $0.20 |
| 知识截止 | 2026年6月 |
有两项参数最关键。100万token的上下文窗口允许研究线程容纳一个代码库、一套文件或一堆源文档,无需中途摘要。缓存读取仅为输入价格的五分之一,让搜索循环依赖的重复读取不再成为成本负担。
价格与Sonnet 5保持一致,变化的是您能获得的能力。
搜索最重要的指标
Anthropic发布了上线基准测试,值得仔细分析。Sonnet 5.5并非在所有方面都领先,但它在与搜索答案实际工作相关的指标上表现突出。
| 基准测试 | Sonnet 5.5 | Sonnet 5 | Opus 5.5 |
|---|---|---|---|
| Terminal-Bench 4.0 | 70.6% | 10.3% | 66.4% |
| FrontierCode 1.1 | 52.1% | 42.4% | 54.4% |
| CursorBench 4.0 | 55.5% | 34.1% | 57.8% |
| OSWorld 2.1 | 80.1% | 57.0% | 81.8% |
| Chartography | 61.6% | 15.6% | 64.4% |
Anthropic发布数据,2026年9月。Terminal-Bench 4.0和CursorBench 4.0为模型最佳表现,FrontierCode 1.1为xhigh。
先看Sonnet 5,再看Sonnet 5.5。Terminal-Bench从10.3%跃升至70.6%。CursorBench几乎翻倍。这不是小幅升级,而是完全不同的模型,价格却未变。

Opus 5.5仍领先的地方只高出一到三个百分点——Anthropic建议,Opus适用于复杂、开放式问题,需要持续判断。对于范围明确的日常工作,差距已缩小到价格成为决定因素。
这如何改变Felo Search的能力
Felo Search中的一次提问不是对单一模型的一次调用,而是一个循环:决定查找内容,读取结果,判断是否足够,继续查找,整合来源,然后输出。规划、工具选择和重试都会消耗token,深入调查可能循环十几次。
这个循环让模型价格变得具体。Opus的定价下,彻底的多轮调查成为实际成本,系统必须控制循环次数。Sonnet 5.5的价格让上限提升。
还有两点进一步影响:
- 输出速度比Sonnet 5提升30%以上。 多轮搜索答案,每轮返回更快,体验不同。
- 每个任务所需token更少。 Anthropic估算典型工作负载最多减少30%。Balyasny Asset Management在2,441个金融任务中测得每个答案约121,000 token,而Sonnet 5约为497,000。Box报告输出速度提升2.4倍,总token减少12%。Slack在更少步骤中获得更好结果,输出token减少约14%。
每个答案token更少,输出更快,单token价格更低,都指向同一个结果:在答案到达前可以进行更多轮验证。
如何在Felo Search使用Claude Sonnet 5.5
1. 打开模型选择器,选中Claude Sonnet 5.5。 同样的搜索框、来源和工作区,界面其他部分无需更改。
2. 提问需要多轮处理的问题。 Sonnet 5.5的优势体现在需要循环的问题:比较、验证、整合。单一事实查询无需此级别。
3. 使用完整上下文,无需裁剪。 100万token足以让所有来源在长时间调查中保持关联,无需摘要到一页,避免丢失后续需要的细节。
4. 让模型自查结果。 在自主基准测试上的提升让多步答案更可信。可以要求模型给出注意事项,而不仅仅是结论。
5. 有针对性地升级。 当问题需要持续判断时,切换到更强模型,已有证据可直接用。共享界面保证交接无缝。
Sonnet 5.5在Felo Search中的定位
Felo Search运行多种模型,选择依据是问题的需求与模型级别的匹配。
| 模型 | 每百万token价格 | 上下文 | 适用场景 |
|---|---|---|---|
| Claude Sonnet 5.5 | $2输入/$10输出 | 1M | 针对范围明确、多步任务,接近Opus质量 |
| Claude Opus 5.5 | $4输入/$20输出 | 1M | 需要严苛验证的答案 |
| GPT-6 Sol | $2输入/$10输出 | 1.05M | 中端价格下的代理循环与重复调用 |
| GPT-6 Luna | $0.10输入/$0.50输出 | 1.05M | 最低每次调用成本的大批量搜索 |
Sonnet 5.5与GPT-6 Sol价格相同,但特性不同:Sol上下文窗口略大,Sonnet 5.5在自主终端编码方面领先,Anthropic专为细致、范围明确的工作调优。可以在两者上运行同一问题,比较注意事项,而非文字表达。
首次尝试建议
一个需要引用的论断。 选一个即将写入文档的统计数据,让Sonnet 5.5追溯其来源。重点在于溯源过程,而非数字本身。
三方比较。 查询三家供应商、价格及各自隐藏的注意事项。此类问题需要多轮检索,正是每轮价格影响最大的场景。
仓库级问题。 针对大量文档,询问某个具体行为的实现方式,并要求引用源文件。
需要辩驳的文档。 粘贴合同,询问未涵盖内容。上下文窗口让“全部阅读”成为可行指令。
在Felo Search体验Claude Sonnet 5.5
Claude Sonnet 5.5已在Felo Search上线,拥有100万token上下文窗口、图片输入和$2/$10定价——与Sonnet 5价格相同,但基准测试结果大幅提升。它在自主终端编码方面以半价超越Opus 5.5,现在即可使用。
在Felo Search体验Claude Sonnet 5.5 →
本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。