Skip to main content

Claude Opus 5.5 现已上线 Felo Search:经得起推敲的答案

· 阅读需 7 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

Claude Opus 5.5 已在 Felo Search 上线:100 万上下文,$4/$20 每百万 token,答案在你采取行动前已与证据核查。

Anthropic 于 9 月 22 日发布了 Claude Opus 5.5,搜索领域关注的数字没有出现在基准表上。那是价格:每百万输入 token $4,每百万输出 $20,而 Opus 5 的价格为 $5 和 $25。Anthropic 表示,在典型工作负载下,运营成本降低约 40%,输出速度提升超过 30%。

Opus 5.5 现已在 Felo Search 上线。更低的价格和更快的速度本身已足够吸引人。值得研究者切换的原因在于模型变得更加严谨。

Claude Opus 5.5 in Felo Search: a one-million-token context holding sources, evidence, and caveats together

Claude Opus 5.5 实际是什么​

Opus 5.5 是 Anthropic 自 9 月公开呼吁放缓前沿开发以来的首次发布。它位于 Opus 系列顶端,高于 Claude Sonnet 5,Fable 系列则用于不同类型的部署。

该规格专为需要被论证的工作设计,而不仅仅是生成内容:100 万 token 上下文窗口、128,000 token 最大输出,以及每百万 token $0.20 的缓存读取费用,使得长时间、反复的会话变得经济。

SpecClaude Opus 5.5
Model IDclaude-opus-5-5
MakerAnthropic
ReleasedSeptember 22, 2026
Context window1,000,000 tokens
Max output128,000 tokens
InputText, image
OutputText
Price$4 per million input, $20 per million output
Cached input$0.20 per million tokens
Prior generationOpus 5, released July 24, 2026 at $5 / $25

表格中的两项参数让研究流程感受到这款模型的不同。

一百万 token 的上下文。 约等于 75 万字,一叠原始文档,无需提前压缩即可直接提问。提前摘要时,错误容易出现:摘要由不了解你需求细节的模型生成。

缓存读取仅为输入价格的五分之一。 Felo Search 的一次调查不是单次调用。它包括初步检索、质疑、修正和综合,每一步都要反复读取同一批资料。缓存让重复读取的成本几乎可以忽略。

为什么“核查”是 AI 搜索的核心问题​

向 AI 搜索引擎提问后,得到的答案表达流畅。这已不再是难点。难点在于,你即将采纳的句子能否经得起核查。

核查与摘要不同。它要求发现两个来源描述同一数据时分母不同。它要求标记某个结论仅有新闻稿作为支撑。它要求在证据薄弱时返回“证据有限”,而不是自信的段落。

Anthropic 在 Opus 5.5 公告中公布了四项基准,值得细读:

BenchmarkClaude Opus 5.5GPT-6 Astra
Terminal-Bench 4.066.4%57.9%
FrontierCode v1.1 (Main)54.4%53.3%
AutomationBench40.0%41.4%
Terminal-Bench-Science 0.158.7%64.6%

Anthropic 在两项领先,两项落后,这比全胜更有参考价值。Astra 在科学密集型终端任务和业务流程自动化上保持优势;Opus 5.5 则在通用代理编码和前沿代码领域表现突出。

方法说明比分数更重要。Anthropic 在评测 Opus 5.5 时启用了生产安全机制:与用户实际使用一致,包括将高风险请求路由至旧模型的策略。只在评测中存在的安全系统不算安全系统。公司还报告,绕过安全边界的尝试比 Opus 5 减少约 85%,对齐表现达到新高。

对于搜索场景,这一配置就是产品本身。拒答的模型让人不便。该拒绝时却流畅作答并给出引用的模型,问题更大。

如何在 Felo Search 使用 Claude Opus 5.5​

1. 在模型选择器中选中它。 打开 Felo Search,选择 Claude Opus 5.5,在常用输入框提问。

2. 提供完整文档集,而非摘要。 百万 token 窗口最适合不再提前压缩。上传所有文件、论文、讨论串等,直接针对全文提问。

3. 明确要求说明限制条件。 “哪些情况会导致结论错误?”、“哪些来源最薄弱?”等问题,核查型模型与摘要模型的回答不同。

4. 要求展示分歧。 来源有冲突时,让模型列出一致与分歧之处,以及证据最薄弱的主张。这才是研究环节真正需要的输出。

5. 在同一线程反复提问。 缓存读取费用低,重开会话成本高。将质疑、修正和最终综合放在同一会话,模型始终保留原始证据。

另外三款模型也在 Felo Search 上线​

Opus 5.5 与另外三款前沿模型几乎同期发布,Felo Search 支持全部四款。

ModelReleased byPrice per million tokensContextBuilt for
Grok 4.7SpaceXAI$2 in / $6 out500K长周期推理与知识工作
Claude Opus 5.5Anthropic$4 in / $20 out1M经得起核查的答案
GPT-6 LunaOpenAI$0.10 in / $0.50 out1.05M低成本高频搜索
GPT-6 SolOpenAI$2 in / $10 out1.05M代理循环与中端价位多轮调用

Opus 5.5 在输出端价格最高,也是唯一公布安全配置和分数的模型。适用于错误代价高于速度的场景。

首次尝试建议​

你准备复述的主张。 选一个即将写入文档的数据,让 Opus 5.5 追溯其来源。关键输出不是数字,而是溯源过程。

有两种合理答案的决策。 提供两个选项和约束条件,询问证据实际支持哪一个,以及哪些因素会改变结论。

你即将签署的文件。 合同、政策、服务条款等,模型指出缺失内容比罗列现有内容更有价值。

你已跑过的研究线程。 重新运行一个月前的问题,对比模型给出的限制条件。差异即为上一代模型未能做到的部分。

立即在 Felo Search 体验 Claude Opus 5.5​

Claude Opus 5.5 已在 Felo Search 上线,拥有百万 token 上下文窗口、$4/$20 价格和生产级安全机制。运营成本比前代低 40%,也是 Anthropic 官方推荐配置。

Open Claude Opus 5.5 in Felo Search →


本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。