Claude Haiku 5.5 已上线 Felo OpenAPI
Anthropic 最便宜、最快的模型在发布当天登陆 Felo OpenAPI。每百万 tokens 输入 $0.10,输出 $0.50,1M 上下文,自适应思考——只需一个 API 密钥。
Anthropic 于 2026 年 10 月 7 日发布了 Claude Haiku 5.5。你现在可以调用它。
Felo OpenAPI 在发布当天新增了 claude-haiku-5-5 路由,价格与 Anthropic 官方一致:每百万输入 tokens $0.10,每百万输出 tokens $0.50,支持最多 100,000 tokens 的提示。这比 Haiku 4.5 便宜 90%,让 Claude 5.5 系列中最快的模型也成为运行成本最低的选择。
试用 Claude Haiku 5.5(Felo OpenAPI):https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

为什么这个版本重要
每一代 Haiku 都很便宜。这是第一款能在 agent 循环中不拖后腿的 Haiku。
Anthropic 称 Haiku 5.5 是迄今为止最便宜、最快、能力最强的小模型。基准测试数据支持这一说法。与前代模型对比:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| 输入 / 输出 | $1 / $5 | $0.10 / $0.50 |
| 缓存读取 | $0.10 | $0.01 |
| 上下文 / 最大输出 | 200K / 64K tokens | 1M / 128K tokens |
| 努力控制 | — | 5 档,默认中等 |
| OSWorld 2.1(电脑操作) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam(无工具) | 10.2% | 45.9% |
价格为每百万 tokens,提示最多 100,000 tokens。基准数据由 Anthropic 提供。
能力提升远超价格下降。在 OSWorld 2.1(电脑操作基准测试)中,Haiku 5.5 得分 72.4%,而 Haiku 4.5 仅为 15.7%。Terminal-Bench 4.0 从 0.0% 提升到 39.2%。过去需要中端模型、价格高出 20 倍的工作,现在可以用 Haiku 系列完成。
价格说明
Haiku 5.5 与 Claude 系列其他模型不同:按提示长度计价。
- 提示不超过 100,000 tokens: 输入 $0.10,输出 $0.50,缓存读取 $0.01——每百万 tokens。
- 提示超过 100,000 tokens: 输入 $0.50,输出 $2.50,缓存读取 $0.05。
其他 Claude 模型在整个上下文窗口内统一计价。Haiku 5.5 是例外,预算 tokens 时需要重新计算。
大多数场景不会触及这个界限。Anthropic 表示,90% 的 Haiku 4.5 请求低于 100,000 tokens,因此能享受完整的 90% 降价。由于 Haiku 5.5 使用新 tokenizer——同样文本 token 数比 Haiku 4.5 多约 30%——Anthropic 估算平均运行成本降幅约为 75%,而非完全的 90%。
需要重点关注的是 $0.01 缓存读取。agent 循环大部分输入预算用于重复读取已发送的上下文;每百万 tokens 只需一分钱,长对话几乎没有额外成本。

其他变化
自适应思考,新增努力档位。 Haiku 5.5 首次支持 effort 参数。思考默认根据任务自适应,五档努力——low、medium、high、xhigh、max,默认 medium——可在成本、速度和响应质量之间权衡。低努力档下,模型在简单请求时直接跳过思考。
1M-token 上下文,128K 最大输出。 上下文窗口是 Haiku 4.5 的五倍,输出上限翻倍。一个窗口约容纳 555,000 字,覆盖大多数代码库、转录文本或文档集。
新 tokenizer。 Haiku 5.5 使用与 Claude 4.7 及后续模型相同的 tokenizer。请求和响应结构不变,但同样文本 token 数更高,需重新调整 max_tokens 限制和成本估算。
浏览器操作与更严格拒绝。 模型支持浏览器操作工具集,安全分类器可直接拒绝请求——客户端需处理 stop_reason 为 "refusal" 的情况。
迁移前需注意的五项重大变更
Haiku 5.5 不能直接替换 Haiku 4.5 的模型 ID。Anthropic 的迁移指南列出了变更,以下五项会导致现有请求无法兼容。
- 手动思考预算被拒绝。
thinking: {"type": "enabled", "budget_tokens": N}会返回 400。需使用自适应思考,并通过effort控制深度。思考文本默认不返回,若需流式传输,设置thinking.display为"summarized"。 - 采样参数被拒绝。 不要传递
temperature、top_p、top_k。任何非默认值都会返回 400,包括top_p: 1。 - 助手预填被拒绝。
messages需以用户回合结束。结构化输出时,使用结构化输出或带枚举字段的分类工具,避免预填技巧。 - 电脑操作迁移至工具集。 在 Claude API 和 Google Cloud 上,将
computer_20250124替换为computer_toolset_20260801。 - 思考块仅限账户且只能追加。 思考块只在生成它的账户内有效,且前序内容不变时才有效。发送思考块时需保持对话追加式。
还有一项隐性变更:思考 tokens 计入 max_tokens,响应可先返回思考块。需按 type 字段筛选内容块,并为 max_tokens 留出思考空间。
完整迁移指南见 Anthropic 文档。
在 Felo OpenAPI 调用 Haiku 5.5
路由已上线。完整集成如下:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPI 提供三种兼容接口,你可以继续使用现有客户端:
| 接口 | 方法 | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages(兼容 Anthropic) | POST | https://openapi.felo.ai/api/v1/messages |
Messages 端点兼容 Anthropic,Claude 客户端只需将 base URL 指向 https://openapi.felo.ai/api。第三方 SDK 同理——设置 baseURL 为 https://openapi.felo.ai/api/v1,无需更改代码。
添加 "stream": true 可启用 SSE。该路由支持推理、工具调用、JSON 输出、流式传输和视觉,功能与其他模型一致。
已订阅 Felo Pro,即可直接访问
Felo Pro 包含 Felo OpenAPI 模型的 API 权限。订阅后,无需新账户即可调用 Haiku 5.5:创建 API 密钥,配置 agent 端点,现有 Felo 积分即可支付调用。一个密钥适用于所有模型——Haiku 5.5、Sonnet 5.5、Opus 5.5、GPT-6、Grok 4.7 等。
需注意两点:
- Felo Pro 积分统一计费。 搜索、智能体、幻灯片、图片和 API 调用共用余额。模型调用按 token 计费,API 大量调用消耗积分速度高于日常搜索。
- 工具 API 独立计费。 模型调用由 Pro 权限覆盖,工具如 Web Fetch、X Search、PPT 生成需用 Felo API Platform 积分。
未订阅 Pro?每个 Felo 账户每日可获 200 免费积分,足够在 Haiku 5.5 上进行真实请求测试。
Haiku 5.5 的适用场景

Haiku 5.5 适合任务简单但量大场景。
- 子智能体与压缩 —— Anthropic 推荐用于摘要、压缩和子智能体。复杂推理用 Opus 5.5 或 Sonnet 5.5,循环部分交给 Haiku 5.5,成本仅十分之一。
- 大批量分类、路由、抽取 —— token 单价决定功能能否上线。每百万输入 tokens $0.10、输出 tokens $0.50,新增一次分类几乎不再受预算限制。
- 客服机器人与低延迟体验 ——全系列最快路由,新增努力档位可进一步缩短响应时间。
- 长文档处理 ——1M 上下文窗口,Haiku 价格可容纳完整转录、合同集或日志文件,无需检索流程。
如需极致推理能力,Opus 5.5 仍为旗舰,且已上线 Felo OpenAPI。Sonnet 5.5 适合大多数生产场景。Haiku 5.5 可用于所有预算曾经不允许的地方。
立即体验
Haiku 5.5 今日已上线 Felo OpenAPI,价格与 Anthropic 官方一致,直接用现有密钥即可调用。
可先在 Playground 测试提示,无需写代码,再创建 API 密钥配置 agent——子智能体、分类器、客服机器人只需更换模型 ID,成本降幅达 90%。
→ 试用 Claude Haiku 5.5(Felo OpenAPI)
本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。