Claude Haiku 5.5がFelo OpenAPIで利用可能に
Anthropicの最も安価で高速なモデルが、リリース初日にFelo OpenAPIで登場。100万トークンあたり$0.10/$0.50、1Mコンテキスト、適応型思考 — 1つのAPIキーで利用可能。
Anthropicは2026年10月7日にClaude Haiku 5.5をリリースした。このモデルを今日から呼び出せる。
Felo OpenAPIはリリース初日にclaude-haiku-5-5ルートを追加した。Anthropicのリスト価格で、100,000トークンまでのプロンプトに対して入力トークン100万あたり$0.10、出力トークン100万あたり$0.50。Haiku 4.5より90%安価になり、Claude 5.5ファミリーで最速のモデルが最も低コストで動作する。
Claude Haiku 5.5をFelo OpenAPIで試す: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

このリリースが重要な理由
Haikuは常に安価だった。今回初めて、エージェントループを弱点なく動作させる。
AnthropicはHaiku 5.5を最も安価で高速、かつ高性能な小型モデルと位置付けている。ベンチマーク結果がその主張を裏付ける。比較対象となるモデルと比べてみると:
| Claude Haiku 4.5 | Claude Haiku 5.5 | |
|---|---|---|
| 入力 / 出力 | $1 / $5 | $0.10 / $0.50 |
| キャッシュ読み取り | $0.10 | $0.01 |
| コンテキスト / 最大出力 | 200K / 64Kトークン | 1M / 128Kトークン |
| 努力コントロール | — | 5段階、デフォルト中 |
| OSWorld 2.1 (PC利用) | 15.7% | 72.4% |
| Terminal-Bench 4.0 | 0.0% | 39.2% |
| GDPval-AA v2.1 | 735 | 1620 |
| Humanity's Last Exam (ツールなし) | 10.2% | 45.9% |
価格は100万トークンあたり、プロンプト最大100,000トークンまで。ベンチマーク値はAnthropic発表。
能力向上は価格低下以上に大きい。OSWorld 2.1のPC利用ベンチマークでは、Haiku 5.5が72.4%を記録し、Haiku 4.5は15.7%だった。Terminal-Bench 4.0は0.0%から39.2%へ。以前は20倍の価格が必要だった中位モデルの仕事も、Haikuラインで対応できる。
価格の仕組み
Haiku 5.5はClaudeファミリーの他モデルと異なり、プロンプト長で価格が決まる。
- 100,000トークンまでのプロンプト: 入力$0.10、出力$0.50、キャッシュ読み取り$0.01 — 100万トークンあたり。
- 100,000トークン超のプロンプト: 入力$0.50、出力$2.50、キャッシュ読み取り$0.05。
他のClaudeモデルは全コンテキストウィンドウで一律料金。Haiku 5.5のみ例外なので、トークン単位で予算を組む場合は再計算が必要。
ほとんどの用途では境界を意識しなくてよい。AnthropicによるとHaiku 4.5リクエストの90%が100,000トークン未満で、価格も90%安くなる。Haiku 5.5は新しいトークナイザーを採用し、同じテキストでもHaiku 4.5より約30%多くトークンがカウントされるため、実際のコスト削減は約75%になる。
$0.01のキャッシュ読み取りが重要。エージェントループは入力予算の大半を既に送信したコンテキストの再読に使う。100万トークンあたり1セントなら、長い会話を維持するコストはほぼゼロになる。

その他の変更点
適応型思考と努力ダイヤル。 Haiku 5.5はeffortパラメータを受け付ける初のHaiku。思考はデフォルトでタスクに適応し、努力レベルは5段階(low, medium, high, xhigh, max、デフォルトはmedium)で、コストや速度と応答品質を調整できる。低い努力では、簡単なリクエストで思考を省略する。
1Mトークンコンテキスト、最大出力128K。 Haiku 4.5の5倍のコンテキストウィンドウと2倍の出力上限。1ウィンドウで約555,000語を保持でき、ほとんどのコードベースやトランスクリプト、ドキュメントセットを1回の呼び出しで扱える。
新しいトークナイザー。 Haiku 5.5はClaude 4.7以降と同じトークナイザーを使用。リクエストや応答の形は変わらないが、同じテキストでもトークン数が増えるため、Haiku 4.5で調整したmax_tokens制限やコスト見積もりは再調整が必要。
ブラウザ利用とより厳格な拒否。 モデルはPC利用ツールセットに加え、ブラウザ利用ツールセットもサポート。安全性分類器がリクエストを直接拒否できるため、クライアントでstop_reasonが"refusal"となる場合を考慮する。
移行前に知っておくべき5つの破壊的変更
Haiku 5.5はHaiku 4.5で動作していたコードのモデルIDを単純に置き換えるだけでは動かない。Anthropicの移行ガイドに変更点が記載されているが、既存リクエストを壊す主な5点を挙げる。
- 手動思考予算は拒否される。
thinking: {"type": "enabled", "budget_tokens": N}は400を返す。適応型思考を使い、effortで深度を調整する。思考テキストはデフォルトで省略されるため、ストリームする場合はthinking.displayを"summarized"に設定する。 - サンプリングパラメータは拒否される。
temperature,top_p,top_kを完全に省略する。デフォルト以外の値は400を返す —top_p: 1も含む。 - アシスタントプリフィルは拒否される。
messagesはユーザーターンで終える。構造化出力にはプリフィルの代わりに構造化出力や分類ツールのenumフィールドを使う。 - PC利用はツールセットに移動。 Claude APIやGoogle Cloudで
computer_20250124をcomputer_toolset_20260801に置き換える。 - 思考ブロックはアカウント単位で追記のみ。 思考ブロックは作成したアカウント内でのみ有効で、前の内容が全て変わらない限り有効。思考ブロックを返す場合は会話を追記のみで管理する。
もう1つの変更はサイレント: 思考トークンがmax_tokensにカウントされ、応答はテキスト前に思考ブロックから始まる場合がある。コンテンツブロックは位置ではなくtypeフィールドで選び、max_tokensに思考分の余裕を持たせる。
詳細な移行ガイドはAnthropicのドキュメントで確認できる。
Felo OpenAPIでHaiku 5.5を呼び出す
ルートは稼働中。統合方法は以下の通り。
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'
Felo OpenAPIは3つの互換サーフェスを提供しているので、既存のクライアントをそのまま使える。
| サーフェス | メソッド | URL |
|---|---|---|
| Chat Completions | POST | https://openapi.felo.ai/api/v1/chat/completions |
| Responses | POST | https://openapi.felo.ai/api/v1/responses |
| Messages (Anthropic互換) | POST | https://openapi.felo.ai/api/v1/messages |
MessagesエンドポイントはAnthropic互換なので、Claudeスタイルのクライアントはhttps://openapi.felo.ai/apiにベースURLを設定するだけでよい。サードパーティSDKも同様 — baseURLをhttps://openapi.felo.ai/api/v1に設定し、既存コードをそのまま使える。
サーバー送信イベントには"stream": trueを追加する。ルートは推論、ツール呼び出し、JSON出力、ストリーミング、ビジョンをサポートし、カタログ内の他モデルと同じサーフェスを持つ。
Felo Pro利用者はすでにアクセス可能
Felo ProにはFelo OpenAPIモデルへのAPIアクセスが含まれる。サブスクしていれば、Haiku 5.5を呼び出すために別アカウントは不要。APIキーを作成し、エージェントをエンドポイントに向ければ、既存のFeloクレジットで呼び出せる。同じキーでHaiku 5.5、Sonnet 5.5、Opus 5.5、GPT-6、Grok 4.7など全ラインナップに対応。
注意すべき点は2つ:
- Felo Proクレジットは1つのプール。 検索、リサーチエージェント、スライド、画像、API呼び出し全て同じ残高から消費される。モデル呼び出しはトークン単位で課金されるため、APIを多用するとクレジット消費が速くなる。
- ツールAPIは別。 モデル呼び出しはProアクセスでカバーされるが、Web FetchやX Search、PPT生成などのツール利用はFelo API Platformクレジットを使う。
Pro未加入でも、全Feloアカウントに1日200クレジット無料が付与される。Haiku 5.5で実際のリクエストを試せる。
Haiku 5.5の用途

Haiku 5.5は、作業が単純だが量が多い場合に最適なルート。
- サブエージェントや要約 — Anthropicは要約、圧縮、サブエージェント用途を推奨している。難しい推論はOpus 5.5やSonnet 5.5で処理し、Haiku 5.5が周辺ループを1/10の価格で担当する。
- 大量分類、ルーティング、抽出 — トークン単価が機能の実装可否を左右する。入力100万トークン$0.10、出力100万トークン$0.50なら、分類1件ごとの追加コストが予算問題にならない。
- サポートボットや低遅延UX — ラインナップ最速ルートで、努力ダイヤルにより応答速度をさらに短縮できる。
- 長文ドキュメント処理 — Haiku価格で1Mウィンドウなら、トランスクリプトや契約書、ログファイル全体を1回の呼び出しで処理できる。
高度な推論の絶対値が必要なら、Opus 5.5がフラッグシップでFelo OpenAPIでも利用できる。Sonnet 5.5は多くの本番用途でバランス点。Haiku 5.5は、予算が理由で導入を見送っていた場面に投入できるモデル。
今すぐ試す
Haiku 5.5はFelo OpenAPIで今日から利用できる。Anthropicのリスト価格で、既存のキーで呼び出せる。
Playgroundでコードを書かずにプロンプトを試し、APIキーを取得してエージェントをエンドポイントに向ければ、サブエージェントや分類器、サポートボットのコストが90%下がる。
→ Claude Haiku 5.5をFelo OpenAPIで試す
この記事は次の言語でもお読みいただけます:English、简体中文、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。