Felo OpenAPIのGPT-6 Astra:105万トークンのコンテキストとエージェントツール
Felo OpenAPIは、105万トークンのコンテキストウィンドウ、12.8万トークンの最大出力、互換性のあるChat Completions、Responses、Messagesエンドポイントを備えたGPT-6 Astraを追加しました。

長文、複雑なコード、多段階のエージェントフローは、チームにモデル呼び出しの分割を求める。Felo OpenAPIはGPT-6 Astraを提供し、1つのモデルIDでこれらのワークロードを互換API経由で処理できる。
GPT-6 Astraを試す:https://openapi.felo.ai/models/openai/gpt-6-astra
GPT-6 Astraの用途
GPT-6 AstraはFelo API PlatformのフラッグシップGPT-6グレード。OpenAIは、複雑な推論、コーディング、コンピュータ操作、リサーチ、ドキュメント作成に最も優れたモデルと説明している。Feloのモデルページには、推論、ツール、JSON、ストリーミング、ビジョンが機能として記載されている。
モデルIDは gpt-6-astra。コンテキストウィンドウは1,050,000トークン、最大出力は128,000トークン。OpenAIは知識カットオフを2026年4月30日と記載。仕様、コードベースの要約、ツール定義、会話履歴を1つの作業コンテキストに保持できる。
OpenAIは推論努力の設定を5つ記載:low、medium、high、xhigh、max。品質目標、レイテンシ予算、リクエストコストに合わせて設定を選択する。
OpenAIの発表によると、GPT-6 AstraはTrusted Access Programの企業向けに展開され、Plus、Pro、Business、Enterpriseは数日以内に利用可能になる。Felo OpenAPIは、APIアクセスが必要な開発者向けにモデルルートを提供する。
3つのプロトコル、1つのモデルID
Felo API Platformは3つの互換リクエストサーフェスを公開している:
- Chat Completions:
POST https://openapi.felo.ai/api/v1/chat/completions - Responses:
POST https://openapi.felo.ai/api/v1/responses - Messages:
POST https://openapi.felo.ai/api/v1/messages
OpenAI互換クライアントを持つアプリは、リクエスト構造を維持し、model値をgpt-6-astraに変更できる。ClaudeスタイルのクライアントはAnthropic互換Messagesサーフェスを利用できる。モデルページにはClaude Code、Codex、LLM API、その他のエージェントクライアントがユースケースとして記載されている。
予算に収まる価格設定
現在のFeloモデルページには以下の料金が記載されている:
| 項目 | 料金 |
|---|---|
| 入力 | $10.00 / 100万トークン |
| 出力 | $50.00 / 100万トークン |
ページには、ローンチ価格が公式プロバイダーAPI料金より最大50%低くなる場合があると記載されている。最終コストはモデル、入力/出力の比率、キャッシュ利用、アクティブプランによって決まる。現在のFeloページには**$10.00 / 100万入力トークン**、$50.00 / 100万出力トークンと記載。コスト見積もりには各変数が含まれるため、見出し料金だけでは全額にならない。
OpenAIのモデルドキュメントには標準料金として**$10.00 / 100万入力トークン**、$1.00 / 100万キャッシュ入力トークン、$50.00 / 100万出力トークンと記載。キャッシュ書き込みは未キャッシュ入力料金の1.25倍。272K入力トークンを超えるリクエストは、入力とキャッシュ料金が2倍、出力が1.5倍になる。BatchとFlexは標準料金の50%、Fastモードは適用料金の2倍。これらはOpenAIの参考料金であり、上記Feloプランの代替ではない。
| 価格ソース | 入力 | キャッシュ入力 | 出力 |
|---|---|---|---|
| Feloモデルページ | $10.00 / 1M | ページにキャッシュ入力・書き込み料金記載 | $50.00 / 1M |
| OpenAIモデルガイド | $10.00 / 1M | $1.00 / 1M | $50.00 / 1M |
5ステップで初リクエスト
1. APIキーを作成
Felo API Platformアカウントでキーを作成し、環境変数として設定する:
export FELO_API_KEY="YOUR_API_KEY"
2. エンドポイントを設定
Chat Completionsの場合:
https://openapi.felo.ai/api/v1/chat/completions
3. モデルIDを設定
"model": "gpt-6-astra"とmessages配列を渡す。このcURLリクエストでルートをテストできる:
curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-astra",
"messages": [{"role": "user", "content": "Explain this API error."}]
}'
4. ツールや構造化出力を追加
互換パラメータにはtools、tool_choice、response_formatが含まれる。各制御のサポートは選択したプロトコルとモデルルートによって異なる。GPT-6 Astraは推論をサポートする。プロトコルとルートが推論制御を公開する場合、会話継続時に返された推論メタデータを保持する。
OpenAIはGPT-6 AstraのResponses APIツールとして、ウェブ検索、ファイル検索、画像生成、コードインタープリタ、ホストシェル、パッチ適用、スキル、コンピュータ操作、MCP、ツール検索を記載。これらのホストツールが必要なワークフローではResponsesエンドポイントを利用する。Feloの公開サーフェスや有効ツールはアクティブルートによって異なる場合がある。
5. ストリーミングを有効化
streamをtrueに設定すると、サーバー送信イベントを受信できる:
{
"model": "gpt-6-astra",
"stream": true,
"messages": [{"role": "user", "content": "Summarize this log."}]
}
事前チェックリスト
- 105万トークンのコンテキストウィンドウに対する入力コストを見積もる。
max_tokensを設定し、出力をプロジェクト予算内に収める。- 各リクエスト見積もりで入力、出力、キャッシュ、プランデータを記録する。
- アプリやエージェントクライアント接続前にPlaygroundでプロンプトをテストする。
- ツール、JSON出力、ストリーミングの回帰サンプルを保持する。
reasoning_effortをサポートレベルに設定し、レイテンシとコストデータとともに記録する。- 比較にはOpenAIの価格ルールを使い、支払見積もりにはFeloプランとルートを利用する。
モデルページから始める
GPT-6 Astraは推論、コーディング、長コンテキスト分析、エージェント作業を1つのモデルエントリで提供する。Felo OpenAPIはChat Completions、Responses、Messagesを通じてチームに移行経路を提供する。既存クライアントはそのまま、リクエストサーフェスだけをワークロードに合わせて変更できる。
GPT-6 Astraモデルページでパラメータ、コードサンプル、Playgroundエントリを確認できる。
出典:Felo API Platform GPT-6 Astraモデルページ、OpenAI GPT-6 Astra発表、OpenAI GPT-6 Astraモデルガイド(2026-09-04アクセス)。Feloの価格は2026-09-04に再確認。