Skip to main content

Claude Sonnet 5.5现已在Felo Search免费开放:接近Opus的答案,Sonnet的价格

· 阅读需 8 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

Claude Sonnet 5.5已上线Felo Search:在Terminal-Bench 4.0上达到70.6%,拥有100万token上下文窗口,定价为$2/$10。以下是对您的研究带来的变化。

Anthropic于2026年9月28日发布了Claude Sonnet 5.5,最引人注目的数字并不是价格,而是在Terminal-Bench 4.0上达到70.6%——比Claude Opus 5.5高出四个百分点,而后者的价格是前者的两倍。

Sonnet 5.5现已在Felo Search上线。作为Sonnet级别的模型,输入每百万token收费$2,输出每百万token收费$10,在大多数任务上缩小了与旗舰模型的差距,并在自主编码方面超越了它。对于需要多步循环才能给出答案的搜索引擎,这种组合比排行榜上的胜利更重要。

Claude Sonnet 5.5在Felo Search:接近Opus的答案,Sonnet的价格,拥有100万token上下文窗口

Claude Sonnet 5.5是什么​

Sonnet 5.5是Anthropic Claude 5.5系列的第二款模型,发布于Opus 5.5之后一周。它不是新的旗舰,而是大多数团队实际在生产环境中使用的级别,这次发布旨在让这个级别足够强大,无需再选择昂贵的旗舰。

规格Claude Sonnet 5.5
模型IDclaude-sonnet-5-5
开发者Anthropic
发布日期2026年9月28日
上下文窗口1,000,000 tokens
最大输出128,000 tokens
输入文本,图片
输出文本
价格输入每百万token $2,输出每百万token $10
缓存输入每百万token $0.20
知识截止2026年6月

有两项参数最关键。100万token的上下文窗口允许研究线程容纳一个代码库、一套文件或一堆源文档,无需中途摘要。缓存读取仅为输入价格的五分之一,让搜索循环依赖的重复读取不再成为成本负担。

价格与Sonnet 5保持一致,变化的是您能获得的能力。

搜索最重要的指标​

Anthropic发布了上线基准测试,值得仔细分析。Sonnet 5.5并非在所有方面都领先,但它在与搜索答案实际工作相关的指标上表现突出。

基准测试Sonnet 5.5Sonnet 5Opus 5.5
Terminal-Bench 4.070.6%10.3%66.4%
FrontierCode 1.152.1%42.4%54.4%
CursorBench 4.055.5%34.1%57.8%
OSWorld 2.180.1%57.0%81.8%
Chartography61.6%15.6%64.4%

Anthropic发布数据,2026年9月。Terminal-Bench 4.0和CursorBench 4.0为模型最佳表现,FrontierCode 1.1为xhigh。

先看Sonnet 5,再看Sonnet 5.5。Terminal-Bench从10.3%跃升至70.6%。CursorBench几乎翻倍。这不是小幅升级,而是完全不同的模型,价格却未变。

Claude Sonnet 5.5在Felo Search:100万token上下文窗口,更快的流程

Opus 5.5仍领先的地方只高出一到三个百分点——Anthropic建议,Opus适用于复杂、开放式问题,需要持续判断。对于范围明确的日常工作,差距已缩小到价格成为决定因素。

这如何改变Felo Search的能力​

Felo Search中的一次提问不是对单一模型的一次调用,而是一个循环:决定查找内容,读取结果,判断是否足够,继续查找,整合来源,然后输出。规划、工具选择和重试都会消耗token,深入调查可能循环十几次。

这个循环让模型价格变得具体。Opus的定价下,彻底的多轮调查成为实际成本,系统必须控制循环次数。Sonnet 5.5的价格让上限提升。

还有两点进一步影响:

  • 输出速度比Sonnet 5提升30%以上。 多轮搜索答案,每轮返回更快,体验不同。
  • 每个任务所需token更少。 Anthropic估算典型工作负载最多减少30%。Balyasny Asset Management在2,441个金融任务中测得每个答案约121,000 token,而Sonnet 5约为497,000。Box报告输出速度提升2.4倍,总token减少12%。Slack在更少步骤中获得更好结果,输出token减少约14%。

每个答案token更少,输出更快,单token价格更低,都指向同一个结果:在答案到达前可以进行更多轮验证。

如何在Felo Search使用Claude Sonnet 5.5​

1. 打开模型选择器,选中Claude Sonnet 5.5。 同样的搜索框、来源和工作区,界面其他部分无需更改。

2. 提问需要多轮处理的问题。 Sonnet 5.5的优势体现在需要循环的问题:比较、验证、整合。单一事实查询无需此级别。

3. 使用完整上下文,无需裁剪。 100万token足以让所有来源在长时间调查中保持关联,无需摘要到一页,避免丢失后续需要的细节。

4. 让模型自查结果。 在自主基准测试上的提升让多步答案更可信。可以要求模型给出注意事项,而不仅仅是结论。

5. 有针对性地升级。 当问题需要持续判断时,切换到更强模型,已有证据可直接用。共享界面保证交接无缝。

Sonnet 5.5在Felo Search中的定位​

Felo Search运行多种模型,选择依据是问题的需求与模型级别的匹配。

模型每百万token价格上下文适用场景
Claude Sonnet 5.5$2输入/$10输出1M针对范围明确、多步任务,接近Opus质量
Claude Opus 5.5$4输入/$20输出1M需要严苛验证的答案
GPT-6 Sol$2输入/$10输出1.05M中端价格下的代理循环与重复调用
GPT-6 Luna$0.10输入/$0.50输出1.05M最低每次调用成本的大批量搜索

Sonnet 5.5与GPT-6 Sol价格相同,但特性不同:Sol上下文窗口略大,Sonnet 5.5在自主终端编码方面领先,Anthropic专为细致、范围明确的工作调优。可以在两者上运行同一问题,比较注意事项,而非文字表达。

首次尝试建议​

一个需要引用的论断。 选一个即将写入文档的统计数据,让Sonnet 5.5追溯其来源。重点在于溯源过程,而非数字本身。

三方比较。 查询三家供应商、价格及各自隐藏的注意事项。此类问题需要多轮检索,正是每轮价格影响最大的场景。

仓库级问题。 针对大量文档,询问某个具体行为的实现方式,并要求引用源文件。

需要辩驳的文档。 粘贴合同,询问未涵盖内容。上下文窗口让“全部阅读”成为可行指令。

在Felo Search体验Claude Sonnet 5.5​

Claude Sonnet 5.5已在Felo Search上线,拥有100万token上下文窗口、图片输入和$2/$10定价——与Sonnet 5价格相同,但基准测试结果大幅提升。它在自主终端编码方面以半价超越Opus 5.5,现在即可使用。

在Felo Search体验Claude Sonnet 5.5 →


本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。