Claude Opus 5.5 现已上线 Felo Search:经得起推敲的答案
Claude Opus 5.5 已在 Felo Search 上线:100 万上下文,$4/$20 每百万 token,答案在你采取行动前已与证据核查。
Anthropic 于 9 月 22 日发布了 Claude Opus 5.5,搜索领域关注的数字没有出现在基准表上。那是价格:每百万输入 token $4,每百万输出 $20,而 Opus 5 的价格为 $5 和 $25。Anthropic 表示,在典型工作负载下,运营成本降低约 40%,输出速度提升超过 30%。
Opus 5.5 现已在 Felo Search 上线。更低的价格和更快的速度本身已足够吸引人。值得研究者切换的原因在于模型变得更加严谨。

Claude Opus 5.5 实际是什么
Opus 5.5 是 Anthropic 自 9 月公开呼吁放缓前沿开发以来的首次发布。它位于 Opus 系列顶端,高于 Claude Sonnet 5,Fable 系列则用于不同类型的部署。
该规格专为需要被论证的工作设计,而不仅仅是生成内容:100 万 token 上下文窗口、128,000 token 最大输出,以及每百万 token $0.20 的缓存读取费用,使得长时间、反复的会话变得经济。
| Spec | Claude Opus 5.5 |
|---|---|
| Model ID | claude-opus-5-5 |
| Maker | Anthropic |
| Released | September 22, 2026 |
| Context window | 1,000,000 tokens |
| Max output | 128,000 tokens |
| Input | Text, image |
| Output | Text |
| Price | $4 per million input, $20 per million output |
| Cached input | $0.20 per million tokens |
| Prior generation | Opus 5, released July 24, 2026 at $5 / $25 |
表格中的两项参数让研究流程感受到这款模型的不同。
一百万 token 的上下文。 约等于 75 万字,一叠原始文档,无需提前压缩即可直接提问。提前摘要时,错误容易出现:摘要由不了解你需求细节的模型生成。
缓存读取仅为输入价格的五分之一。 Felo Search 的一次调查不是单次调用。它包括初步检索、质疑、修正和综合,每一步都要反复读取同一批资料。缓存让重复读取的成本几乎可以忽略。
为什么“核查”是 AI 搜索的核心问题
向 AI 搜索引擎提问后,得到的答案表达流畅。这已不再是难点。难点在于,你即将采纳的句子能否经得起核查。
核查与摘要不同。它要求发现两个来源描述同一数据时分母不同。它要求标记某个结论仅有新闻稿作为支撑。它要求在证据薄弱时返回“证据有限”,而不是自信的段落。
Anthropic 在 Opus 5.5 公告中公布了四项基准,值得细读:
| Benchmark | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|
| Terminal-Bench 4.0 | 66.4% | 57.9% |
| FrontierCode v1.1 (Main) | 54.4% | 53.3% |
| AutomationBench | 40.0% | 41.4% |
| Terminal-Bench-Science 0.1 | 58.7% | 64.6% |
Anthropic 在两项领先,两项落后,这比全胜更有参考价值。Astra 在科学密集型终端任务和业务流程自动化上保持优势;Opus 5.5 则在通用代理编码和前沿代码领域表现突出。
方法说明比分数更重要。Anthropic 在评测 Opus 5.5 时启用了生产安全机制:与用户实际使用一致,包括将高风险请求路由至旧模型的策略。只在评测中存在的安全系统不算安全系统。公司还报告,绕过安全边界的尝试比 Opus 5 减少约 85%,对齐表现达到新高。
对于搜索场景,这一配置就是产品本身。拒答的模型让人不便。该拒绝时却流畅作答并给出引用的模型,问题更大。
如何在 Felo Search 使用 Claude Opus 5.5
1. 在模型选择器中选中它。 打开 Felo Search,选择 Claude Opus 5.5,在常用输入框提问。
2. 提供完整文档集,而非摘要。 百万 token 窗口最适合不再提前压缩。上传所有文件、论文、讨论串等,直接针对全文提问。
3. 明确要求说明限制条件。 “哪些情况会导致结论错误?”、“哪些来源最薄弱?”等问题,核查型模型与摘要模型的回答不同。
4. 要求展示分歧。 来源有冲突时,让模型列出一致与分歧之处,以及证据最薄弱的主张。这才是研究环节真正需要的输出。
5. 在同一线程反复提问。 缓存读取费用低,重开会话成本高。将质疑、修正和最终综合放在同一会话,模型始终保留原始证据。
另外三款模型也在 Felo Search 上线
Opus 5.5 与另外三款前沿模型几乎同期发布,Felo Search 支持全部四款。
| Model | Released by | Price per million tokens | Context | Built for |
|---|---|---|---|---|
| Grok 4.7 | SpaceXAI | $2 in / $6 out | 500K | 长周期推理与知识工作 |
| Claude Opus 5.5 | Anthropic | $4 in / $20 out | 1M | 经得起核查的答案 |
| GPT-6 Luna | OpenAI | $0.10 in / $0.50 out | 1.05M | 低成本高频搜索 |
| GPT-6 Sol | OpenAI | $2 in / $10 out | 1.05M | 代理循环与中端价位多轮调用 |
Opus 5.5 在输出端价格最高,也是唯一公布安全配置和分数的模型。适用于错误代价高于速度的场景。
首次尝试建议
你准备复述的主张。 选一个即将写入文档的数据,让 Opus 5.5 追溯其来源。关键输出不是数字,而是溯源过程。
有两种合理答案的决策。 提供两个选项和约束条件,询问证据实际支持哪一个,以及哪些因素会改变结论。
你即将签署的文件。 合同、政策、服务条款等,模型指出缺失内容比罗列现有内容更有价值。
你已跑过的研究线程。 重新运行一个月前的问题,对比模型给出的限制条件。差异即为上一代模型未能做到的部分。
立即在 Felo Search 体验 Claude Opus 5.5
Claude Opus 5.5 已在 Felo Search 上线,拥有百万 token 上下文窗口、$4/$20 价格和生产级安全机制。运营成本比前代低 40%,也是 Anthropic 官方推荐配置。
Open Claude Opus 5.5 in Felo Search →
本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。