Skip to main content

Felo OpenAPIでのGPT-6 Astra:1.05Mコンテキスト、ひとつのモデルID

· 約4分
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo OpenAPIは、1.05Mコンテキストウィンドウ、128K最大出力、互換性のあるChat Completions、Responses、Messagesエンドポイントを持つGPT-6 Astraを追加しました。

GPT-6 Astra API infographic cover showing 1.05M context, 128K max output, $5 input, and $30 output

長文ドキュメント、複雑なコード、多段階のエージェントフローは、チームにモデル呼び出しの分割を強います。Felo OpenAPIはGPT-6 Astraを提供し、ひとつのモデルIDでこれらのワークロードを互換APIサーフェスで処理します。

GPT-6 Astraを試す:https://openapi.felo.ai/models/openai/gpt-6-astra

GPT-6 Astraの用途

GPT-6 AstraはFelo API PlatformのフラッグシップGPT-6グレードです。モデルページは、複雑な推論、高度なコーディング、長文コンテキスト解析、高機能エージェントワークフロー向けと位置付けます。機能として推論、ツール、JSON、ストリーミング、ビジョンを挙げます。

モデルIDは gpt-6-astra です。コンテキストウィンドウは1.05Mトークン、最大出力は128Kトークンです。この容量で、リクエストに仕様、コードベース要約、ツール定義、会話履歴をひとつの作業コンテキストに保持します。

3つのプロトコル、ひとつのモデルID

Felo API Platformは3つの互換リクエストサーフェスを公開します:

  • Chat Completions: POST https://openapi.felo.ai/api/v1/chat/completions
  • Responses: POST https://openapi.felo.ai/api/v1/responses
  • Messages: POST https://openapi.felo.ai/api/v1/messages

OpenAI互換クライアントを持つアプリは、リクエスト構造を維持し、model値をgpt-6-astraに変更します。ClaudeスタイルのクライアントはAnthropic互換Messagesサーフェスを利用します。モデルページはClaude Code、Codex、LLM API、他のエージェントクライアントをユースケースとして挙げます。

予算に収まる料金

モデルページは次の料金を示します:

項目料金
入力$5.00 / 1Mトークン
出力$30.00 / 1Mトークン

ページは、ローンチ料金が公式プロバイダーAPI料金の最大50%低下となる場合があると記載します。最終コストはモデル、入出力比率、キャッシュ利用、アクティブプランで決まります。コスト見積もりは各変数を含みます。見出しの料金だけが請求額ではありません。

5ステップで最初のリクエスト

1. APIキーを作成

Felo API Platformアカウントでキーを作成し、環境変数に設定します:

export FELO_API_KEY="YOUR_API_KEY"

2. エンドポイントを設定

Chat Completionsの場合:

https://openapi.felo.ai/api/v1/chat/completions

3. モデルIDを設定

"model": "gpt-6-astra"messages配列を渡します。次のcURLリクエストでルートをテストします:

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'

4. ツールや構造化出力を追加

互換パラメータにはtoolstool_choiceresponse_formatが含まれます。各コントロールのサポートは選択したプロトコルとモデルルートによります。GPT-6 Astraは推論をサポートします。プロトコルとルートが推論コントロールを公開する場合、会話継続時に返却された推論メタデータを保持します。

5. ストリーミングを有効化

streamtrueに設定し、サーバー送信イベントを受信します:

{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}

事前チェックリスト

  • 1.05Mコンテキストウィンドウに対する入力コストを見積もります。
  • max_tokensを設定し、出力をプロジェクト予算内に収めます。
  • 各リクエスト見積もりで入力、出力、キャッシュ、プランデータを記録します。
  • アプリやエージェントクライアント接続前にPlaygroundでプロンプトをテストします。
  • ツール、JSON出力、ストリーミングの回帰サンプルを保持します。

モデルページから始める

GPT-6 Astraは推論、コーディング、長文コンテキスト解析、エージェント作業をひとつのモデルエントリに集約します。Felo OpenAPIはChat Completions、Responses、Messagesを通じてチームに移行経路を提供します。既存クライアントはそのまま、リクエストサーフェスだけをワークロードに合わせて変更します。

GPT-6 Astraモデルページでパラメータ、コードサンプル、Playgroundエントリを確認します。

出典:Felo API Platform、GPT-6 Astraモデルページ(2026-09-03アクセス)