Skip to main content

Claude Haiku 5.5がFelo OpenAPIで利用可能に

· 約10分
Felo Search Tips Buddy
Committed to answers at your fingertips

Anthropicの最も安価で高速なモデルが、リリース初日にFelo OpenAPIで登場。100万トークンあたり$0.10/$0.50、1Mコンテキスト、適応型思考 — 1つのAPIキーで利用可能。

Anthropicは2026年10月7日にClaude Haiku 5.5をリリースした。このモデルを今日から呼び出せる。

Felo OpenAPIはリリース初日にclaude-haiku-5-5ルートを追加した。Anthropicのリスト価格で、100,000トークンまでのプロンプトに対して入力トークン100万あたり$0.10、出力トークン100万あたり$0.50。Haiku 4.5より90%安価になり、Claude 5.5ファミリーで最速のモデルが最も低コストで動作する。

Claude Haiku 5.5をFelo OpenAPIで試す: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 on Felo OpenAPI: Anthropic's fastest Haiku route, 90% cheaper than Haiku 4.5

このリリースが重要な理由​

Haikuは常に安価だった。今回初めて、エージェントループを弱点なく動作させる。

AnthropicはHaiku 5.5を最も安価で高速、かつ高性能な小型モデルと位置付けている。ベンチマーク結果がその主張を裏付ける。比較対象となるモデルと比べてみると:

Claude Haiku 4.5Claude Haiku 5.5
入力 / 出力$1 / $5$0.10 / $0.50
キャッシュ読み取り$0.10$0.01
コンテキスト / 最大出力200K / 64Kトークン1M / 128Kトークン
努力コントロール—5段階、デフォルト中
OSWorld 2.1 (PC利用)15.7%72.4%
Terminal-Bench 4.00.0%39.2%
GDPval-AA v2.17351620
Humanity's Last Exam (ツールなし)10.2%45.9%

価格は100万トークンあたり、プロンプト最大100,000トークンまで。ベンチマーク値はAnthropic発表。

能力向上は価格低下以上に大きい。OSWorld 2.1のPC利用ベンチマークでは、Haiku 5.5が72.4%を記録し、Haiku 4.5は15.7%だった。Terminal-Bench 4.0は0.0%から39.2%へ。以前は20倍の価格が必要だった中位モデルの仕事も、Haikuラインで対応できる。

価格の仕組み​

Haiku 5.5はClaudeファミリーの他モデルと異なり、プロンプト長で価格が決まる。

  • 100,000トークンまでのプロンプト: 入力$0.10、出力$0.50、キャッシュ読み取り$0.01 — 100万トークンあたり。
  • 100,000トークン超のプロンプト: 入力$0.50、出力$2.50、キャッシュ読み取り$0.05。

他のClaudeモデルは全コンテキストウィンドウで一律料金。Haiku 5.5のみ例外なので、トークン単位で予算を組む場合は再計算が必要。

ほとんどの用途では境界を意識しなくてよい。AnthropicによるとHaiku 4.5リクエストの90%が100,000トークン未満で、価格も90%安くなる。Haiku 5.5は新しいトークナイザーを採用し、同じテキストでもHaiku 4.5より約30%多くトークンがカウントされるため、実際のコスト削減は約75%になる。

$0.01のキャッシュ読み取りが重要。エージェントループは入力予算の大半を既に送信したコンテキストの再読に使う。100万トークンあたり1セントなら、長い会話を維持するコストはほぼゼロになる。

Claude Haiku 5.5 pricing: $0.10 per million input tokens up to a 100,000-token prompt, and a 90% drop from Haiku 4.5

その他の変更点​

適応型思考と努力ダイヤル。 Haiku 5.5はeffortパラメータを受け付ける初のHaiku。思考はデフォルトでタスクに適応し、努力レベルは5段階(low, medium, high, xhigh, max、デフォルトはmedium)で、コストや速度と応答品質を調整できる。低い努力では、簡単なリクエストで思考を省略する。

1Mトークンコンテキスト、最大出力128K。 Haiku 4.5の5倍のコンテキストウィンドウと2倍の出力上限。1ウィンドウで約555,000語を保持でき、ほとんどのコードベースやトランスクリプト、ドキュメントセットを1回の呼び出しで扱える。

新しいトークナイザー。 Haiku 5.5はClaude 4.7以降と同じトークナイザーを使用。リクエストや応答の形は変わらないが、同じテキストでもトークン数が増えるため、Haiku 4.5で調整したmax_tokens制限やコスト見積もりは再調整が必要。

ブラウザ利用とより厳格な拒否。 モデルはPC利用ツールセットに加え、ブラウザ利用ツールセットもサポート。安全性分類器がリクエストを直接拒否できるため、クライアントでstop_reasonが"refusal"となる場合を考慮する。

移行前に知っておくべき5つの破壊的変更​

Haiku 5.5はHaiku 4.5で動作していたコードのモデルIDを単純に置き換えるだけでは動かない。Anthropicの移行ガイドに変更点が記載されているが、既存リクエストを壊す主な5点を挙げる。

  1. 手動思考予算は拒否される。 thinking: {"type": "enabled", "budget_tokens": N}は400を返す。適応型思考を使い、effortで深度を調整する。思考テキストはデフォルトで省略されるため、ストリームする場合はthinking.displayを"summarized"に設定する。
  2. サンプリングパラメータは拒否される。 temperature, top_p, top_kを完全に省略する。デフォルト以外の値は400を返す — top_p: 1も含む。
  3. アシスタントプリフィルは拒否される。 messagesはユーザーターンで終える。構造化出力にはプリフィルの代わりに構造化出力や分類ツールのenumフィールドを使う。
  4. PC利用はツールセットに移動。 Claude APIやGoogle Cloudでcomputer_20250124をcomputer_toolset_20260801に置き換える。
  5. 思考ブロックはアカウント単位で追記のみ。 思考ブロックは作成したアカウント内でのみ有効で、前の内容が全て変わらない限り有効。思考ブロックを返す場合は会話を追記のみで管理する。

もう1つの変更はサイレント: 思考トークンがmax_tokensにカウントされ、応答はテキスト前に思考ブロックから始まる場合がある。コンテンツブロックは位置ではなくtypeフィールドで選び、max_tokensに思考分の余裕を持たせる。

詳細な移行ガイドはAnthropicのドキュメントで確認できる。

Felo OpenAPIでHaiku 5.5を呼び出す​

ルートは稼働中。統合方法は以下の通り。

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPIは3つの互換サーフェスを提供しているので、既存のクライアントをそのまま使える。

サーフェスメソッドURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (Anthropic互換)POSThttps://openapi.felo.ai/api/v1/messages

MessagesエンドポイントはAnthropic互換なので、Claudeスタイルのクライアントはhttps://openapi.felo.ai/apiにベースURLを設定するだけでよい。サードパーティSDKも同様 — baseURLをhttps://openapi.felo.ai/api/v1に設定し、既存コードをそのまま使える。

サーバー送信イベントには"stream": trueを追加する。ルートは推論、ツール呼び出し、JSON出力、ストリーミング、ビジョンをサポートし、カタログ内の他モデルと同じサーフェスを持つ。

Felo Pro利用者はすでにアクセス可能​

Felo ProにはFelo OpenAPIモデルへのAPIアクセスが含まれる。サブスクしていれば、Haiku 5.5を呼び出すために別アカウントは不要。APIキーを作成し、エージェントをエンドポイントに向ければ、既存のFeloクレジットで呼び出せる。同じキーでHaiku 5.5、Sonnet 5.5、Opus 5.5、GPT-6、Grok 4.7など全ラインナップに対応。

注意すべき点は2つ:

  • Felo Proクレジットは1つのプール。 検索、リサーチエージェント、スライド、画像、API呼び出し全て同じ残高から消費される。モデル呼び出しはトークン単位で課金されるため、APIを多用するとクレジット消費が速くなる。
  • ツールAPIは別。 モデル呼び出しはProアクセスでカバーされるが、Web FetchやX Search、PPT生成などのツール利用はFelo API Platformクレジットを使う。

Pro未加入でも、全Feloアカウントに1日200クレジット無料が付与される。Haiku 5.5で実際のリクエストを試せる。

Haiku 5.5の用途​

Where Claude Haiku 5.5 fits: high-volume classification, extraction, and subagent work between Sonnet 5.5 and Opus 5.5

Haiku 5.5は、作業が単純だが量が多い場合に最適なルート。

  • サブエージェントや要約 — Anthropicは要約、圧縮、サブエージェント用途を推奨している。難しい推論はOpus 5.5やSonnet 5.5で処理し、Haiku 5.5が周辺ループを1/10の価格で担当する。
  • 大量分類、ルーティング、抽出 — トークン単価が機能の実装可否を左右する。入力100万トークン$0.10、出力100万トークン$0.50なら、分類1件ごとの追加コストが予算問題にならない。
  • サポートボットや低遅延UX — ラインナップ最速ルートで、努力ダイヤルにより応答速度をさらに短縮できる。
  • 長文ドキュメント処理 — Haiku価格で1Mウィンドウなら、トランスクリプトや契約書、ログファイル全体を1回の呼び出しで処理できる。

高度な推論の絶対値が必要なら、Opus 5.5がフラッグシップでFelo OpenAPIでも利用できる。Sonnet 5.5は多くの本番用途でバランス点。Haiku 5.5は、予算が理由で導入を見送っていた場面に投入できるモデル。

今すぐ試す​

Haiku 5.5はFelo OpenAPIで今日から利用できる。Anthropicのリスト価格で、既存のキーで呼び出せる。

Playgroundでコードを書かずにプロンプトを試し、APIキーを取得してエージェントをエンドポイントに向ければ、サブエージェントや分類器、サポートボットのコストが90%下がる。

→ Claude Haiku 5.5をFelo OpenAPIで試す

→ APIキーを作成する


この記事は次の言語でもお読みいただけます:English、简体中文、한국어、繁體中文、हिन्दी、Français、العربية、Русский、اردو、Bahasa Indonesia、Deutsch、Tiếng Việt、Türkçe、Italiano、ไทย、Español、বাংলা、Português。