Skip to main content

Claude Haiku 5.5 已上线 Felo OpenAPI

· 阅读需 9 分钟
Felo Search Tips Buddy
Committed to answers at your fingertips

Anthropic 最便宜、最快的模型在发布当天登陆 Felo OpenAPI。每百万 tokens 输入 $0.10,输出 $0.50,1M 上下文,自适应思考——只需一个 API 密钥。

Anthropic 于 2026 年 10 月 7 日发布了 Claude Haiku 5.5。你现在可以调用它。

Felo OpenAPI 在发布当天新增了 claude-haiku-5-5 路由,价格与 Anthropic 官方一致:每百万输入 tokens $0.10,每百万输出 tokens $0.50,支持最多 100,000 tokens 的提示。这比 Haiku 4.5 便宜 90%,让 Claude 5.5 系列中最快的模型也成为运行成本最低的选择。

试用 Claude Haiku 5.5(Felo OpenAPI):https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 on Felo OpenAPI: Anthropic's fastest Haiku route, 90% cheaper than Haiku 4.5

为什么这个版本重要​

每一代 Haiku 都很便宜。这是第一款能在 agent 循环中不拖后腿的 Haiku。

Anthropic 称 Haiku 5.5 是迄今为止最便宜、最快、能力最强的小模型。基准测试数据支持这一说法。与前代模型对比:

Claude Haiku 4.5Claude Haiku 5.5
输入 / 输出$1 / $5$0.10 / $0.50
缓存读取$0.10$0.01
上下文 / 最大输出200K / 64K tokens1M / 128K tokens
努力控制—5 档,默认中等
OSWorld 2.1(电脑操作)15.7%72.4%
Terminal-Bench 4.00.0%39.2%
GDPval-AA v2.17351620
Humanity's Last Exam(无工具)10.2%45.9%

价格为每百万 tokens,提示最多 100,000 tokens。基准数据由 Anthropic 提供。

能力提升远超价格下降。在 OSWorld 2.1(电脑操作基准测试)中,Haiku 5.5 得分 72.4%,而 Haiku 4.5 仅为 15.7%。Terminal-Bench 4.0 从 0.0% 提升到 39.2%。过去需要中端模型、价格高出 20 倍的工作,现在可以用 Haiku 系列完成。

价格说明​

Haiku 5.5 与 Claude 系列其他模型不同:按提示长度计价。

  • 提示不超过 100,000 tokens: 输入 $0.10,输出 $0.50,缓存读取 $0.01——每百万 tokens。
  • 提示超过 100,000 tokens: 输入 $0.50,输出 $2.50,缓存读取 $0.05。

其他 Claude 模型在整个上下文窗口内统一计价。Haiku 5.5 是例外,预算 tokens 时需要重新计算。

大多数场景不会触及这个界限。Anthropic 表示,90% 的 Haiku 4.5 请求低于 100,000 tokens,因此能享受完整的 90% 降价。由于 Haiku 5.5 使用新 tokenizer——同样文本 token 数比 Haiku 4.5 多约 30%——Anthropic 估算平均运行成本降幅约为 75%,而非完全的 90%。

需要重点关注的是 $0.01 缓存读取。agent 循环大部分输入预算用于重复读取已发送的上下文;每百万 tokens 只需一分钱,长对话几乎没有额外成本。

Claude Haiku 5.5 pricing: $0.10 per million input tokens up to a 100,000-token prompt, and a 90% drop from Haiku 4.5

其他变化​

自适应思考,新增努力档位。 Haiku 5.5 首次支持 effort 参数。思考默认根据任务自适应,五档努力——low、medium、high、xhigh、max,默认 medium——可在成本、速度和响应质量之间权衡。低努力档下,模型在简单请求时直接跳过思考。

1M-token 上下文,128K 最大输出。 上下文窗口是 Haiku 4.5 的五倍,输出上限翻倍。一个窗口约容纳 555,000 字,覆盖大多数代码库、转录文本或文档集。

新 tokenizer。 Haiku 5.5 使用与 Claude 4.7 及后续模型相同的 tokenizer。请求和响应结构不变,但同样文本 token 数更高,需重新调整 max_tokens 限制和成本估算。

浏览器操作与更严格拒绝。 模型支持浏览器操作工具集,安全分类器可直接拒绝请求——客户端需处理 stop_reason 为 "refusal" 的情况。

迁移前需注意的五项重大变更​

Haiku 5.5 不能直接替换 Haiku 4.5 的模型 ID。Anthropic 的迁移指南列出了变更,以下五项会导致现有请求无法兼容。

  1. 手动思考预算被拒绝。 thinking: {"type": "enabled", "budget_tokens": N} 会返回 400。需使用自适应思考,并通过 effort 控制深度。思考文本默认不返回,若需流式传输,设置 thinking.display 为 "summarized"。
  2. 采样参数被拒绝。 不要传递 temperature、top_p、top_k。任何非默认值都会返回 400,包括 top_p: 1。
  3. 助手预填被拒绝。 messages 需以用户回合结束。结构化输出时,使用结构化输出或带枚举字段的分类工具,避免预填技巧。
  4. 电脑操作迁移至工具集。 在 Claude API 和 Google Cloud 上,将 computer_20250124 替换为 computer_toolset_20260801。
  5. 思考块仅限账户且只能追加。 思考块只在生成它的账户内有效,且前序内容不变时才有效。发送思考块时需保持对话追加式。

还有一项隐性变更:思考 tokens 计入 max_tokens,响应可先返回思考块。需按 type 字段筛选内容块,并为 max_tokens 留出思考空间。

完整迁移指南见 Anthropic 文档。

在 Felo OpenAPI 调用 Haiku 5.5​

路由已上线。完整集成如下:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI 提供三种兼容接口,你可以继续使用现有客户端:

接口方法URL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages(兼容 Anthropic)POSThttps://openapi.felo.ai/api/v1/messages

Messages 端点兼容 Anthropic,Claude 客户端只需将 base URL 指向 https://openapi.felo.ai/api。第三方 SDK 同理——设置 baseURL 为 https://openapi.felo.ai/api/v1,无需更改代码。

添加 "stream": true 可启用 SSE。该路由支持推理、工具调用、JSON 输出、流式传输和视觉,功能与其他模型一致。

已订阅 Felo Pro,即可直接访问​

Felo Pro 包含 Felo OpenAPI 模型的 API 权限。订阅后,无需新账户即可调用 Haiku 5.5:创建 API 密钥,配置 agent 端点,现有 Felo 积分即可支付调用。一个密钥适用于所有模型——Haiku 5.5、Sonnet 5.5、Opus 5.5、GPT-6、Grok 4.7 等。

需注意两点:

  • Felo Pro 积分统一计费。 搜索、智能体、幻灯片、图片和 API 调用共用余额。模型调用按 token 计费,API 大量调用消耗积分速度高于日常搜索。
  • 工具 API 独立计费。 模型调用由 Pro 权限覆盖,工具如 Web Fetch、X Search、PPT 生成需用 Felo API Platform 积分。

未订阅 Pro?每个 Felo 账户每日可获 200 免费积分,足够在 Haiku 5.5 上进行真实请求测试。

Haiku 5.5 的适用场景​

Where Claude Haiku 5.5 fits: high-volume classification, extraction, and subagent work between Sonnet 5.5 and Opus 5.5

Haiku 5.5 适合任务简单但量大场景。

  • 子智能体与压缩 —— Anthropic 推荐用于摘要、压缩和子智能体。复杂推理用 Opus 5.5 或 Sonnet 5.5,循环部分交给 Haiku 5.5,成本仅十分之一。
  • 大批量分类、路由、抽取 —— token 单价决定功能能否上线。每百万输入 tokens $0.10、输出 tokens $0.50,新增一次分类几乎不再受预算限制。
  • 客服机器人与低延迟体验 ——全系列最快路由,新增努力档位可进一步缩短响应时间。
  • 长文档处理 ——1M 上下文窗口,Haiku 价格可容纳完整转录、合同集或日志文件,无需检索流程。

如需极致推理能力,Opus 5.5 仍为旗舰,且已上线 Felo OpenAPI。Sonnet 5.5 适合大多数生产场景。Haiku 5.5 可用于所有预算曾经不允许的地方。

立即体验​

Haiku 5.5 今日已上线 Felo OpenAPI,价格与 Anthropic 官方一致,直接用现有密钥即可调用。

可先在 Playground 测试提示,无需写代码,再创建 API 密钥配置 agent——子智能体、分类器、客服机器人只需更换模型 ID,成本降幅达 90%。

→ 试用 Claude Haiku 5.5(Felo OpenAPI)

→ 创建你的 API 密钥


本文还提供以下语言版本:English、日本語、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。